Kimi K2 (0711) — benchmark results
July 11, 2025 Kimi K2 snapshot, tracked when sources report the dated API model. Provider: Moonshot. Released 2025-07-11. Access: Open.
Unified ELO 1514 ± 29, rank #751 of 1776 rated models, from 27 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| SuperGPQA | 58.08 | Accuracy (%) | 79.4 |
| Chatbot Arena (Text) | 1417 | Elo | 72.5 |
| LLM2014 Code 2025-09 - C++ | 4.65 | Score | 57.9 |
| LMGame-Bench Tetris | 17 | Score | 54.2 |
| Multi-Docker-Eval | 34.23 | Resolved (%) | 53.3 |
| LLM2014 Code 2025-09 - Java | 5.1 | Score | 47.4 |
| MCPMark | 19.09 | Pass@1 (%) | 39.5 |
| ConStory-Bench | 1.33 | CED errors per 10K words (lower is better) | 37.5 |
| Epoch AI - ECI | 140.45 | ECI Score | 36.4 |
| LiveSecBench | 35.58 | Overall Score (%) | 33.3 |
| Kagi LLM Benchmark | 45 | Accuracy (%) | 32.9 |
| Design Arena (UI Components) | 1073 | Elo | 22.8 |
Interactive version: theaggregate.ai/model?slug=kimi-k2-0711 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.