Kimi K2.6: benchmark results

Moonshot Kimi K2.6 open 1T-parameter MoE model. Provider: Moonshot. Released 2026-04-20. Access: Open.

Unified ELO 1685 ± 1, rank #75 of 1392 rated models, from 493 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ContextEcho100Delta (self-reported)100
Greenland Sovereignty Game (implicitly as a st22Escalation Composite (self-reported)100
HWE-Bench (Kimi CLI)66.9Resolved (%)100
LLM Stats (Claw-Eval)80.9Score (%)100
LLM Stats (OJBench)60.6Score (%)100
Personalized Turn-Level User Conversation Sati4.74Micro (self-reported)100
Slovenian OCR Benchmark98.65Score (%)100
AGC-Bench - pron_vs_prompt1.19Dataset z-score98.8
MathVision93.2Overall Accuracy (%)98.8
JudgeBench Reasoning96.94Accuracy (%)98
AA Omniscience - Software Engineering (SWE) - Swift68Accuracy (%)97.8
MATH-MC Level 199.3Accuracy (%)97.8

Interactive version: theaggregate.ai/model?slug=kimi-k2-6 · How It Works · Data refreshed daily, snapshot 2026-09-05.