Kimi K2.6 (Non-reasoning): benchmark results

Kimi K2.6 evaluated with reasoning disabled. Provider: Moonshot. Released 2026-04-20. Access: Open.

Unified ELO 1613 ± 1, rank #373 of 1761 rated models, from 36 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Software Engineering (SWE) - Rust74Accuracy (%)95.1
UGI - Writing64.19Writing Score95
UGI - Natural Intelligence59.46NatInt Score93.7
AA Omniscience - Software Engineering (SWE) - Go40Accuracy (%)93.2
AA Omniscience - Software Engineering (SWE) - PHP48Accuracy (%)92.3
AA Omniscience - Software Engineering (SWE) - Kotlin40Accuracy (%)91.6
AA TAU-2 Bench93.86Accuracy (%)91.1
AA Omniscience - Software Engineering (SWE) - C60Accuracy (%)90.8
AA Omniscience - Software Engineering (SWE) - Python37Accuracy (%)89.4
AA Omniscience - Software Engineering (SWE) - Java29Accuracy (%)88.9
AA Omniscience - Software Engineering (SWE) - TypeScript43.33Accuracy (%)88.1
AA Omniscience - Software Engineering (SWE) - Swift52Accuracy (%)86.7

Interactive version: theaggregate.ai/model?slug=kimi-k2-6-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.