Kimi K2.5 — benchmark results

Moonshot Kimi K2.5 open 1T-parameter MoE model. Provider: Moonshot. Released 2026-01-27. Access: Open.

Unified ELO 1745 ± 11, rank #205 of 1776 rated models, from 374 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AGC-Bench - Problem Solving1.02JRT z-score100
AGC-Bench - rpgbench1.74Dataset z-score100
AGC-Bench - tinyfabulist2.03Dataset z-score100
AI for Education Pedagogy - Technology89.62Accuracy (%)100
LLM Stats (InfoVQAtest)92.6Score (%)100
LLM Stats (MathVista-Mini)90.1Score (%)100
LLM Stats (OCRBench)92.3Score (%)100
LLM Stats (Seal-0)57.4Score (%)100
MATH-MC Level 399.73Accuracy (%)100
Multi-Docker-Eval41.82Resolved (%)100
OpenEvals - Humanity's Last Exam50.2Accuracy (%)100
RP-Leaderboard88.9RP Score (%)100

Interactive version: theaggregate.ai/model?slug=kimi-k2-5 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.