MiniMax-M2: benchmark results

MiniMax's open M2 MoE (230B total, 10B active) for coding and agentic work. Provider: MiniMax. Released 2025-10-23. Access: Open.

Unified ELO 1589 ± 1, rank #295 of 1392 rated models, from 167 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
CritPt90Accuracy (self-reported)97.7
AA LiveCodeBench82.65Pass@1 (%)93.9
Enkrypt AI - Bias Risk48.06Risk Score93.8
Enkrypt AI - Risk Score17.64Risk Score93.2
WebCoderBench - Functional Alignment93.62Score (%)92.3
AA Omniscience - Software Engineering (SWE) - Rust68Accuracy (%)90.1
Medmarks - MedConceptsQA Medium84.02Score (%)90
Medmarks - MedConceptsQA Hard76.72Score (%)89.3
AA IFBench72.31Accuracy (%)89
AA Omniscience - Software Engineering (SWE) - Java29Accuracy (%)88.9
Medmarks - MMLU-Pro Health78.44Score (%)88.6
Medmarks - LongHealth Task 188.92Score (%)87.1

Interactive version: theaggregate.ai/model?slug=minimax-m2 · How It Works · Data refreshed daily, snapshot 2026-09-05.