Kimi K2 (0711): benchmark results

July 11, 2025 Kimi K2 snapshot, tracked when sources report the dated API model. Provider: Moonshot. Released 2025-07-11. Access: Open.

Unified ELO 1555 ± 1, rank #418 of 1392 rated models, from 43 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SuperGPQA58.08Accuracy (%)79.4
Chatbot Arena (Text)1418Elo70.6
Chatbot Arena (Text - Multi-Turn)1419Arena Score69.3
Chatbot Arena (Text - English)1426Arena Score68.8
Chatbot Arena (Text - Coding)1460Arena Score68.7
Chatbot Arena (Text - Chinese)1454Arena Score68.5
Chatbot Arena (Text - German)1421Arena Score68.5
Chatbot Arena (Text - Russian)1410Arena Score68.5
Chatbot Arena (Text - Hard Prompts)1432Arena Score68.2
Chatbot Arena (Text - Japanese)1375Arena Score64.2
Chatbot Arena (Text - Creative Writing)1370Arena Score64.1
Chatbot Arena (Text - Instruction Following)1380Arena Score59.6

Interactive version: theaggregate.ai/model?slug=kimi-k2-0711 · How It Works · Data refreshed daily, snapshot 2026-09-05.