MiniMax-M2.5 — benchmark results

MiniMax's open M2.5 MoE (230B total, 10B active) for cost-efficient coding and agentic work. Provider: MiniMax. Released 2026-01-15. Access: Open.

Unified ELO 1649 ± 11, rank #368 of 1776 rated models, from 264 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ActTraitBench2.17G_KD (Global Knowledge-Decision Gap) (self-reported)100
AA TAU-2 Bench95.32Accuracy (%)94.5
GSMA Open-Telco - srsRAN-Bench84.67Score (%)93.6
OpenEvals - SWE-bench Verified75.8Resolved (%)92.9
GSM-MC99.39Accuracy (%)91.8
PinTrace45.42ρ_U(%) (self-reported)88.9
AA IFBench71.63Accuracy (%)88.3
AA-LCR66Score (self-reported)87
UGI - Natural Intelligence38.64NatInt Score86.6
MATH-MC Level 198.84Accuracy (%)85.3
JudgeBench Math92.86Accuracy (%)84.3
AA Long Context Reasoning66Accuracy (%)84.1

Interactive version: theaggregate.ai/model?slug=minimax-m2-5 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.