Kimi K2.6 — benchmark results

Moonshot Kimi K2.6 open 1T-parameter MoE model. Provider: Moonshot. Released 2026-04-20. Access: Open.

Unified ELO 1749 ± 10, rank #199 of 1776 rated models, from 363 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LLM Stats (Claw-Eval)80.9Score (%)100
LLM Stats (OJBench)60.6Score (%)100
LLM Stats (WideSearch)80.8Score (%)100
Slovenian OCR Benchmark98.65Score (%)100
StructureClaw (Automatic Workflow)100Success Rate (%)100
AGC-Bench - pron_vs_prompt1.19Dataset z-score98.8
MathVision93.2Overall Accuracy (%)98.8
JudgeBench Reasoning96.94Accuracy (%)98
MATH-MC Level 199.3Accuracy (%)97.8
OpenCompass Math - Competition72.1Score (%)97.7
AGC-Bench - conceptual_design1.57Dataset z-score97.6
AGC-Bench - hypogen1.95Dataset z-score97.6

Interactive version: theaggregate.ai/model?slug=kimi-k2-6 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.