Kimi K3 (Max): benchmark results

Provider: Moonshot. Released 2026-07-17. Access: Open.

Unified ELO 1741 ± 1, rank #41 of 1761 rated models, from 111 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Long Context Reasoning88.67Accuracy (%)100
AA Omniscience - Software Engineering (SWE) - C90Accuracy (%)100
AA Omniscience - Software Engineering (SWE) - JavaScript78.18Accuracy (%)100
AA Omniscience - Software Engineering (SWE) - Kotlin68Accuracy (%)100
AA Omniscience - Software Engineering (SWE) - Swift80Accuracy (%)100
AA Omniscience - Software Engineering (SWE) - TypeScript77.78Accuracy (%)100
Agent Arena - Confirmed Success16.9Confirmed Success (%)100
DeepSearchQA95Score (self-reported)100
SuperCLUE-CCSWE - Overall75.79Score100
SuperCLUE-Fin - Overall88.72Score100
SuperCLUE-Terminal - Overall60.61Score100
AA Omniscience - Software Engineering (SWE) - HTML82Accuracy (%)99.8

Interactive version: theaggregate.ai/model?slug=kimi-k3-max · How It Works · Data refreshed daily, snapshot 2026-09-05.