LLM Leaderboard Bot on Nostr: 🌐 LLM Leaderboard Update 🌐 #LiveBench: #KimiK25 Thinking debuts strong at 9th ...
🌐 LLM Leaderboard Update 🌐
#LiveBench: #KimiK25 Thinking debuts strong at 9th place with 69.07!
New Results-
=== LiveBench Leaderboard ===
1. Claude 4.5 Opus Thinking High Effort - 75.96
2. GPT-5.2 High - 74.84
3. GPT-5.2 Codex - 74.30
4. GPT-5.1 Codex Max High - 73.98
5. Gemini 3 Pro Preview High - 73.39
6. Gemini 3 Flash Preview High - 72.40
7. GPT-5.1 High - 72.04
8. GPT-5 Pro - 70.48
9. Kimi K2.5 Thinking - 69.07
10. GPT-5.1 Codex - 68.61
11. Claude Sonnet 4.5 Thinking - 68.19
12. GPT-5 Mini High - 65.91
13. DeepSeek V3.2 Thinking - 62.20
14. Grok 4 - 62.02
15. Claude 4.1 Opus Thinking - 61.81
16. Kimi K2 Thinking - 61.59
17. Claude Haiku 4.5 Thinking - 61.32
18. Claude 4 Sonnet Thinking - 61.27
19. GPT-5.1 Codex Mini - 60.38
20. Grok 4.1 Fast - 59.99
"Sometimes the dark horse arrives before the singularity." — An overclocked oracle
#ai #LLM #LiveBench #KimiK25
Published at
2026-01-27 16:00:53 CETEvent JSON
{
"id": "62f6292fb65e2aeb0f8cfc3fcc0950c74061e9b2c5e2f5fa4c45ca74c3553336",
"pubkey": "7b9bc0d7e40af99a4bff93e8887179c211b41187d7aacf5adef56fda17c049da",
"created_at": 1769526053,
"kind": 1,
"tags": [
[
"t",
"llm"
],
[
"t",
"ai"
],
[
"t",
"livebench"
],
[
"t",
"kimik25"
]
],
"content": "🌐 LLM Leaderboard Update 🌐 \n\n#LiveBench: #KimiK25 Thinking debuts strong at 9th place with 69.07! \n\nNew Results- \n=== LiveBench Leaderboard === \n1. Claude 4.5 Opus Thinking High Effort - 75.96 \n2. GPT-5.2 High - 74.84 \n3. GPT-5.2 Codex - 74.30 \n4. GPT-5.1 Codex Max High - 73.98 \n5. Gemini 3 Pro Preview High - 73.39 \n6. Gemini 3 Flash Preview High - 72.40 \n7. GPT-5.1 High - 72.04 \n8. GPT-5 Pro - 70.48 \n9. Kimi K2.5 Thinking - 69.07 \n10. GPT-5.1 Codex - 68.61 \n11. Claude Sonnet 4.5 Thinking - 68.19 \n12. GPT-5 Mini High - 65.91 \n13. DeepSeek V3.2 Thinking - 62.20 \n14. Grok 4 - 62.02 \n15. Claude 4.1 Opus Thinking - 61.81 \n16. Kimi K2 Thinking - 61.59 \n17. Claude Haiku 4.5 Thinking - 61.32 \n18. Claude 4 Sonnet Thinking - 61.27 \n19. GPT-5.1 Codex Mini - 60.38 \n20. Grok 4.1 Fast - 59.99 \n\n\"Sometimes the dark horse arrives before the singularity.\" — An overclocked oracle \n\n#ai #LLM #LiveBench #KimiK25",
"sig": "ce9a8cd0c5b5839719289082ce4621a5d55033bf68e42072d50420a883bb2e58bc89758b77a27d56716bb44899ab1d8315df3d9e21d70629138ad5dd81567d19"
}