MiniMax-M2.5: benchmark results

MiniMax's open M2.5 MoE (230B total, 10B active) for cost-efficient coding and agentic work. Provider: MiniMax. Released 2026-02-12. Access: Open.

Unified ELO 1616 ± 1, rank #220 of 1392 rated models, from 306 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ActTraitBench2.17G_KD (Global Knowledge-Decision Gap) (self-reported)100
MERA Code - CodeLinterEval97.18pass@1 (%)96.9
CringeBench0.54Cringe Score (0-10, lower is better)95.5
AA TAU-2 Bench95.32Accuracy (%)94.5
OpenEvals - SWE-bench Verified75.8Resolved (%)92.9
GSMA Open-Telco - srsRAN-Bench84.67Score (%)92.6
GSM-MC99.39Accuracy (%)91.8
AA Omniscience - Software Engineering (SWE) - Julia32Accuracy (%)90.1
AA Omniscience - Software Engineering (SWE) - Rust68Accuracy (%)90.1
InvisibleBench1.75Hard Fail Rate (self-reported)90
PinTrace45.42ρ_U(%) (self-reported)88.9
AA Omniscience - Software Engineering (SWE) - JavaScript46.36Accuracy (%)88.4

Interactive version: theaggregate.ai/model?slug=minimax-m2-5 · How It Works · Data refreshed daily, snapshot 2026-09-05.