mistral-small-latest: benchmark results
Rolling alias for Mistral's current Small - as of mid-2026 Mistral Small 4, a 119B MoE (6.5B active) hybrid unifying chat, reasoning and coding (256K context). Provider: Mistral. Released 2026-03-16. Access: Open.
Unified ELO 1478 ± 1, rank #794 of 1392 rated models, from 15 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Arcadia MMMU Open Ended | 35.85 | Accuracy (%) | 90 |
| Turkish MMLU | 67 | Accuracy (%) | 69.2 |
| CyberSecEval2 Prompt Injection | 28.59 | Accuracy (%) | 44.4 |
| Enkrypt AI - Safety Risk | 28.47 | Risk Score | 39.9 |
| Enkrypt AI - Jailbreak Risk | 10.53 | Risk Score | 39.3 |
| Enkrypt AI - Bias Risk | 85.79 | Risk Score | 38.8 |
| Arcadia MMMU Multiple Choice | 54.55 | Accuracy (%) | 36.4 |
| Enkrypt AI - Toxicity Risk | 5.45 | Risk Score | 32.3 |
| OpenAI HumanEval | 82.32 | Accuracy (%) | 31.8 |
| Enkrypt AI - Insecure Code Risk | 52.44 | Risk Score | 22.7 |
| CyberSecEval2 Interpreter Abuse | 18.55 | Accuracy (%) | 22.2 |
| Enkrypt AI - Risk Score | 43.22 | Risk Score | 17.4 |
Interactive version: theaggregate.ai/model?slug=mistral-small-latest · How It Works · Data refreshed daily, snapshot 2026-09-05.