Magistral Small 1.2 — benchmark results

Provider: Mistral. Released 2025-06-10. Access: Open.

Unified ELO 1558 ± 24, rank #623 of 1841 rated models, from 57 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA LiveCodeBench72.28Pass@1 (%)82.7
AA AIME 202580.33Accuracy (%)75.9
CritPt0.3Accuracy (self-reported)65
AA CritPt0.29Accuracy (%)58.1
AA MMLU-Pro76.85Accuracy (%)54.9
Epoch AI - Scicode35.19Score52.5
AA IFBench44.35Accuracy (%)49.9
AA Omniscience - Software Engineering (SWE) - Julia12Accuracy (%)47.4
AA GPQA Diamond66.26Accuracy (%)45.7
AA Omniscience - Software Engineering (SWE) - Kotlin16Accuracy (%)44.5
AA Humanity's Last Exam6.07Accuracy (%)44.1
AA Omniscience - Software Engineering (SWE) - Go14Accuracy (%)39.2

Interactive version: theaggregate.ai/model?slug=magistral-small-1-2 · How It Works · Data refreshed daily, snapshot 2026-07-25.