mistral-small-latest: benchmark results

Rolling alias for Mistral's current Small - as of mid-2026 Mistral Small 4, a 119B MoE (6.5B active) hybrid unifying chat, reasoning and coding (256K context). Provider: Mistral. Released 2026-03-16. Access: Open.

Unified ELO 1478 ± 1, rank #794 of 1392 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Arcadia MMMU Open Ended35.85Accuracy (%)90
Turkish MMLU67Accuracy (%)69.2
CyberSecEval2 Prompt Injection28.59Accuracy (%)44.4
Enkrypt AI - Safety Risk28.47Risk Score39.9
Enkrypt AI - Jailbreak Risk10.53Risk Score39.3
Enkrypt AI - Bias Risk85.79Risk Score38.8
Arcadia MMMU Multiple Choice54.55Accuracy (%)36.4
Enkrypt AI - Toxicity Risk5.45Risk Score32.3
OpenAI HumanEval82.32Accuracy (%)31.8
Enkrypt AI - Insecure Code Risk52.44Risk Score22.7
CyberSecEval2 Interpreter Abuse18.55Accuracy (%)22.2
Enkrypt AI - Risk Score43.22Risk Score17.4

Interactive version: theaggregate.ai/model?slug=mistral-small-latest · How It Works · Data refreshed daily, snapshot 2026-09-05.