Mistral Small 3 — benchmark results

January 2025 Mistral Small 3 model row. Provider: Mistral. Released 2025-01-30. Access: Open.

Unified ELO 1527 ± 9, rank #693 of 1776 rated models, from 223 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Italian Common Sense Reasoning82.73Common Sense Reasoning Average Score (%)98.9
EuroEval French Common Sense Reasoning83.43Common Sense Reasoning Average Score (%)98.8
EuroEval German NLU - Sb10K62.27Sentiment classification Score (%)98.8
MT-Bench PL - Extraction9.9Judge Score (0-10)96.9
EuroEval English Common Sense Reasoning88.02Common Sense Reasoning Average Score (%)96.8
EuroEval Spanish Common Sense Reasoning81.7Common Sense Reasoning Average Score (%)96.6
EuroEval German Common Sense Reasoning82.04Common Sense Reasoning Average Score (%)96.4
EuroEval Portuguese Common Sense Reasoning92.94Common Sense Reasoning Average Score (%)96.2
EVALITA - lexical-substitution52.67CPS95.7
EuroEval Swedish Common Sense Reasoning78.67Common Sense Reasoning Average Score (%)95.7
EuroEval Spanish NLU - Sentiment Headlines ES51.95Sentiment classification Score (%)95.6
EuroEval English76.05Average Score (%)94.3

Interactive version: theaggregate.ai/model?slug=mistral-small-3 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.