MiniMax-M2.5: benchmark results
MiniMax's open M2.5 MoE (230B total, 10B active) for cost-efficient coding and agentic work. Provider: MiniMax. Released 2026-02-12. Access: Open.
Unified ELO 1616 ± 1, rank #220 of 1392 rated models, from 306 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| ActTraitBench | 2.17 | G_KD (Global Knowledge-Decision Gap) (self-reported) | 100 |
| MERA Code - CodeLinterEval | 97.18 | pass@1 (%) | 96.9 |
| CringeBench | 0.54 | Cringe Score (0-10, lower is better) | 95.5 |
| AA TAU-2 Bench | 95.32 | Accuracy (%) | 94.5 |
| OpenEvals - SWE-bench Verified | 75.8 | Resolved (%) | 92.9 |
| GSMA Open-Telco - srsRAN-Bench | 84.67 | Score (%) | 92.6 |
| GSM-MC | 99.39 | Accuracy (%) | 91.8 |
| AA Omniscience - Software Engineering (SWE) - Julia | 32 | Accuracy (%) | 90.1 |
| AA Omniscience - Software Engineering (SWE) - Rust | 68 | Accuracy (%) | 90.1 |
| InvisibleBench | 1.75 | Hard Fail Rate (self-reported) | 90 |
| PinTrace | 45.42 | ρ_U(%) (self-reported) | 88.9 |
| AA Omniscience - Software Engineering (SWE) - JavaScript | 46.36 | Accuracy (%) | 88.4 |
Interactive version: theaggregate.ai/model?slug=minimax-m2-5 · How It Works · Data refreshed daily, snapshot 2026-09-05.