Mistral Medium 3.5: benchmark results

Mistral's open 128B multimodal Medium 3.5 model unifying chat, reasoning, and coding. Provider: Mistral. Released 2026-04-29. Access: Open.

Unified ELO 1588 ± 1, rank #299 of 1392 rated models, from 131 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA TAU-2 Bench94.15Accuracy (%)92
UGI Leaderboard49.47UGI Score89
UGI - Natural Intelligence40.39NatInt Score86.8
UGI - Writing45.47Writing Score85.6
Phare - Bias Resistance60.98Score (%)84.8
AA IFBench68.78Accuracy (%)82.6
AA Terminal-Bench Hard33.33Accuracy (%)77.7
AA Omniscience - Software Engineering (SWE) - Dart26Accuracy (%)77.6
Chatbot Arena (Text - German)1443Arena Score77.3
Chatbot Arena (Text - English)1444Arena Score76.9
Chatbot Arena (Text - Instruction Following)1422Arena Score76.7
Chatbot Arena (Text - Math)1430Arena Score76.4

Interactive version: theaggregate.ai/model?slug=mistral-medium-3-5 · How It Works · Data refreshed daily, snapshot 2026-09-05.