Mistral Small (2402): benchmark results

February 2024 Mistral Small API snapshot (mistral-small-2402). Provider: Mistral. Released 2024-02-26. Access: Open.

Unified ELO 1421 ± 1, rank #1061 of 1392 rated models, from 19 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
BenchBench47.79Aggregate Score (%)50
MMLU68.7Accuracy (%)49.6
HELM WMT 201416.86BLEU-4 (%)26.7
HELM Lite32.31Mean win rate (self-reported)23.7
HELM NaturalQuestions (Closed)30.42F1 (%)23.3
HELM (Stanford)28.77Mean Win Rate (%)20
BigCodeBench32.1Pass@1 (%)19.8
Epoch AI - Dtbench52.96Score16.2
Vals AI MATH 50070.6Accuracy (%)15.5
Vals AI GPQA50.76Accuracy (%)12.4
HELM NaturalQuestions (Open)58.69F1 (%)11.1
HELM NarrativeQA51.92F1 (%)8.9

Interactive version: theaggregate.ai/model?slug=mistral-small-2402 · How It Works · Data refreshed daily, snapshot 2026-09-05.