Kimi K3 (Low): benchmark results

Provider: Moonshot. Released 2026-07-16. Access: Open.

Unified ELO 1696 ± 1, rank #148 of 3078 rated models, from 92 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Software Engineering (SWE) - Dart66Accuracy (%)100
FlavourBench - Pairing73.72Pairing Family Score (0-100)100
PSF-Med - Frontier Hardest 5005.71Paraphrase Flip Rate (%)100
AA Omniscience - Software Engineering (SWE) - HTML82Accuracy (%)99.8
AA Omniscience - Software Engineering (SWE) - PHP80Accuracy (%)99.7
AA Omniscience - Software Engineering (SWE) - TypeScript75.28Accuracy (%)99.7
AA Omniscience - Software Engineering (SWE) - C81Accuracy (%)99.3
AA Omniscience - Software Engineering (SWE) - Kotlin64Accuracy (%)99.3
AA Omniscience - Software Engineering (SWE) - Swift76Accuracy (%)99.3
AA Omniscience - Software Engineering (SWE) - JavaScript70.91Accuracy (%)99
AA Omniscience - Software Engineering (SWE) - Python64.5Accuracy (%)99
AA Omniscience - Software Engineering (SWE) - Rust80Accuracy (%)99

Interactive version: theaggregate.ai/model?slug=kimi-k3-low · How It Works · Data refreshed daily, snapshot 2026-09-19.