K2-V2 (Medium) — benchmark results

Provider: LLM360. Released 2026-01-27. Access: Open.

Unified ELO 1530 ± 34, rank #723 of 1841 rated models, from 53 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA IFBench55.1Accuracy (%)66.4
AA Omniscience - Software Engineering (SWE) - Kotlin24Accuracy (%)63.4
AA Omniscience - Software Engineering (SWE) - Java21Accuracy (%)63.1
AA AIME 202564.67Accuracy (%)60.4
AA LiveCodeBench54.07Pass@1 (%)60.2
AA Omniscience - Software Engineering (SWE) - HTML34Accuracy (%)58.4
AA MMLU-Pro76.07Accuracy (%)52.3
AA Omniscience - Software Engineering (SWE) - TypeScript22.22Accuracy (%)49.6
AA Omniscience - Software Engineering (SWE) - Swift36Accuracy (%)47.1
AA-LCR28Score (self-reported)47.1
AA Omniscience - Health18.3Accuracy (%)46
AA Omniscience - Software Engineering (SWE) - R10Accuracy (%)44.9

Interactive version: theaggregate.ai/model?slug=k2-v2-medium · How It Works · Data refreshed daily, snapshot 2026-07-25.