Kimi K2.5 (Non-reasoning): benchmark results

Kimi K2.5 evaluated with reasoning disabled. Provider: Moonshot. Released 2026-01-27. Access: Open.

Unified ELO 1586 ± 1, rank #490 of 1761 rated models, from 79 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI - Natural Intelligence60.32NatInt Score94
UGI - Writing61.51Writing Score93.7
AA Omniscience - Software Engineering (SWE) - PHP48Accuracy (%)92.3
AA Omniscience - Software Engineering (SWE) - Rust70Accuracy (%)92.2
CritPt60Accuracy (self-reported)91.9
AA Omniscience - Software Engineering (SWE) - C60Accuracy (%)90.8
AA Omniscience - Software Engineering (SWE) - Python38Accuracy (%)89.8
AA Omniscience - Software Engineering (SWE) - HTML52Accuracy (%)88.9
AA Omniscience - Software Engineering (SWE) - R30Accuracy (%)88.7
AA Omniscience - Software Engineering (SWE) - Go34Accuracy (%)88.1
AA Omniscience - Software Engineering (SWE) - JavaScript41.82Accuracy (%)85
AA Omniscience - Software Engineering (SWE) - TypeScript38.89Accuracy (%)85

Interactive version: theaggregate.ai/model?slug=kimi-k2-5-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.