Magistral Medium 1.2: benchmark results

Provider: Mistral. Released 2025-09-17. Access: API.

Unified ELO 1684 ± 19, rank #358 of 2656 rated models, from 107 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA LiveCodeBench75.03Pass@1 (%)86.5
CritPt30Accuracy (self-reported)80.8
SnorkelSpatial44.24Accuracy@1 (%, 330 spatial reasoning questions)78.1
AA AIME 202582Accuracy (%)77.6
AA-Omniscience Hallucination Rate59.98Hallucination Rate (%)75.9
AA MMLU-Pro81.51Accuracy (%)75.3
AIME 202491.8Score (percentage)75
Wolfram LLM Benchmarking Project51.7Correct Functionality (%)72.1
AA Omniscience - Software Engineering (SWE) - Rust54Accuracy (%)68.9
AA Omniscience - Software Engineering (SWE) - Julia16Accuracy (%)68.8
AA Omniscience - Software Engineering (SWE) - Kotlin22Accuracy (%)68.6
AA Omniscience - Software Engineering (SWE) - Go22Accuracy (%)68.4

Interactive version: theaggregate.ai/model?slug=magistral-medium-1-2 · How It Works · Data refreshed daily, snapshot 2026-09-19.