Kimi K3 (Low) — benchmark results

Provider: Moonshot. Released 2026-07-17. Access: Open.

Unified ELO 1893 ± 20, rank #65 of 1839 rated models, from 36 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Tau3 Banking34.02Success Rate (%)100
AA Omniscience - Software Engineering (SWE) - HTML82Accuracy (%)97.5
AA Omniscience - Software Engineering (SWE) - PHP80Accuracy (%)96
AA Omniscience - Software Engineering (SWE) - Dart64Accuracy (%)94.9
Artificial Analysis Intelligence Index46.6Intelligence Index94.4
Epoch AI - Scicode51.16Score93.6
AA Omniscience - Software Engineering (SWE) - TypeScript71.11Accuracy (%)93.4
AA Omniscience - Science, Engineering & Mathematics45.9Accuracy (%)93.3
AA Omniscience - Software Engineering (SWE) - Rust78Accuracy (%)93.3
AA Omniscience - Software Engineering (SWE) - R58Accuracy (%)92.4
AA Omniscience - Humanities & Social Sciences42.2Accuracy (%)92
AA Omniscience - Software Engineering (SWE) - C79Accuracy (%)92

Interactive version: theaggregate.ai/model?slug=kimi-k3-low · How It Works · Data refreshed daily, snapshot 2026-08-05.