Mistral Small (2402): benchmark results
February 2024 Mistral Small API snapshot (mistral-small-2402). Provider: Mistral. Released 2024-02-26. Access: Open.
Unified ELO 1421 ± 1, rank #1061 of 1392 rated models, from 19 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| BenchBench | 47.79 | Aggregate Score (%) | 50 |
| MMLU | 68.7 | Accuracy (%) | 49.6 |
| HELM WMT 2014 | 16.86 | BLEU-4 (%) | 26.7 |
| HELM Lite | 32.31 | Mean win rate (self-reported) | 23.7 |
| HELM NaturalQuestions (Closed) | 30.42 | F1 (%) | 23.3 |
| HELM (Stanford) | 28.77 | Mean Win Rate (%) | 20 |
| BigCodeBench | 32.1 | Pass@1 (%) | 19.8 |
| Epoch AI - Dtbench | 52.96 | Score | 16.2 |
| Vals AI MATH 500 | 70.6 | Accuracy (%) | 15.5 |
| Vals AI GPQA | 50.76 | Accuracy (%) | 12.4 |
| HELM NaturalQuestions (Open) | 58.69 | F1 (%) | 11.1 |
| HELM NarrativeQA | 51.92 | F1 (%) | 8.9 |
Interactive version: theaggregate.ai/model?slug=mistral-small-2402 · How It Works · Data refreshed daily, snapshot 2026-09-05.