K2 Think V2: benchmark results

MBZUAI's open sovereign 70B reasoning model, RL-trained on the K2-V2 base. Provider: LLM360. Released 2026-01-27. Access: Open.

Unified ELO 1531 ± 1, rank #756 of 1919 rated models, from 35 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA IFBench62.79Accuracy (%)73.7
AA Omniscience - Software Engineering (SWE) - JavaScript33.64Accuracy (%)69.1
AA Omniscience - Software Engineering (SWE) - Kotlin20Accuracy (%)63
AA Omniscience - Software Engineering (SWE) - HTML32Accuracy (%)60.4
AA Omniscience - Software Engineering (SWE) - Rust50Accuracy (%)59
AA Omniscience - Software Engineering (SWE) - Julia12Accuracy (%)58
AA Omniscience - Software Engineering (SWE) - TypeScript21.11Accuracy (%)57.5
BenchmarkList ECI112.49Capability Index (ECI)54.1
AA Humanity's Last Exam10.1Accuracy (%)53.8
AA Omniscience - Software Engineering (SWE) - R10Accuracy (%)53.4
AA Long Context Reasoning57Accuracy (%)52.8
Artificial Analysis Intelligence Index11.5Intelligence Index50.7

Interactive version: theaggregate.ai/model?slug=k2-think-v2 · How It Works · Data refreshed daily, snapshot 2026-09-08.