Kimi K2.6 (Non-reasoning) — benchmark results

Kimi K2.6 evaluated with reasoning disabled. Provider: Moonshot. Released 2026-04-20. Access: Open.

Unified ELO 1762 ± 32, rank #176 of 1776 rated models, from 35 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI - Writing64.19Writing Score95.7
UGI - Natural Intelligence59.46NatInt Score94.4
AA TAU-2 Bench93.86Accuracy (%)91.1
AA Terminal-Bench Hard37.88Accuracy (%)84.9
AA Omniscience - Software Engineering (SWE) - Rust68Accuracy (%)83.1
AA Omniscience - Software Engineering (SWE) - Go40Accuracy (%)82.9
Artificial Analysis Intelligence Index34.58Intelligence Index82.8
AA Omniscience - Software Engineering (SWE) - PHP48Accuracy (%)82.7
AA Omniscience - Software Engineering (SWE) - Kotlin36Accuracy (%)80.5
AA Omniscience-9.97Score79.7
AA Humanity's Last Exam18.16Accuracy (%)77.4
AA Omniscience - Software Engineering (SWE) - C57Accuracy (%)77.2

Interactive version: theaggregate.ai/model?slug=kimi-k2-6-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.