Kimi K2.6: benchmark results
Moonshot Kimi K2.6 open 1T-parameter MoE model. Provider: Moonshot. Released 2026-04-20. Access: Open.
Unified ELO 1685 ± 1, rank #75 of 1392 rated models, from 493 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| ContextEcho | 100 | Delta (self-reported) | 100 |
| Greenland Sovereignty Game (implicitly as a st | 22 | Escalation Composite (self-reported) | 100 |
| HWE-Bench (Kimi CLI) | 66.9 | Resolved (%) | 100 |
| LLM Stats (Claw-Eval) | 80.9 | Score (%) | 100 |
| LLM Stats (OJBench) | 60.6 | Score (%) | 100 |
| Personalized Turn-Level User Conversation Sati | 4.74 | Micro (self-reported) | 100 |
| Slovenian OCR Benchmark | 98.65 | Score (%) | 100 |
| AGC-Bench - pron_vs_prompt | 1.19 | Dataset z-score | 98.8 |
| MathVision | 93.2 | Overall Accuracy (%) | 98.8 |
| JudgeBench Reasoning | 96.94 | Accuracy (%) | 98 |
| AA Omniscience - Software Engineering (SWE) - Swift | 68 | Accuracy (%) | 97.8 |
| MATH-MC Level 1 | 99.3 | Accuracy (%) | 97.8 |
Interactive version: theaggregate.ai/model?slug=kimi-k2-6 · How It Works · Data refreshed daily, snapshot 2026-09-05.