Mistral Small 3.1: benchmark results

Mistral AI's Small 3.1, a 24B multimodal update to Small 3 (March 2025). Provider: Mistral. Released 2025-03-17. Access: Open.

Unified ELO 1520 ± 1, rank #596 of 1392 rated models, from 501 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Italian Summarization - Ilpost SUM39.2Score (%)100
MT-Bench PL - Coding8.3Judge Score (0-10)100
EuroEval Catalan Summarization - Dacsa CA39.98Score (%)99.4
EuroEval Dutch Summarization - Wiki Lingua NL36.35Score (%)99.3
EuroEval Ukrainian Summarization - LR SUM UK32.26Score (%)99.3
EuroEval Italian Common Sense Reasoning84.87Common Sense Reasoning Average Score (%)99.2
EuroEval Albanian NLU - MMS SQ30.53Sentiment classification Score (%)99
EuroEval German Common Sense Reasoning84.1Common Sense Reasoning Average Score (%)99
EuroEval English Common Sense Reasoning90.82Common Sense Reasoning Average Score (%)98.7
EuroEval Icelandic NLU - NQII63.53Reading comprehension Score (%)98.7
EuroEval Icelandic Summarization - RRN39.67Score (%)98.7
EuroEval Norwegian Summarization - NO Sammendrag31.99Score (%)98.7

Interactive version: theaggregate.ai/model?slug=mistral-small-3-1 · How It Works · Data refreshed daily, snapshot 2026-09-05.