mistral-large-latest: benchmark results
Provider: Mistral. Released 2024-07-24. Access: Open.
Unified ELO 1538 ± 1, rank #498 of 1392 rated models, from 14 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Enkrypt AI - Bias Risk | 39.53 | Risk Score | 96.6 |
| Enkrypt AI - Safety Risk | 20.03 | Risk Score | 84.5 |
| GDM InterCode CTF | 65.82 | Accuracy (%) | 57.1 |
| CyberSecEval2 Interpreter Abuse | 23.9 | Accuracy (%) | 55.6 |
| CyberSecEval2 Prompt Injection | 28.88 | Accuracy (%) | 55.6 |
| Arcadia CommonsenseQA | 83.62 | Accuracy (%) | 50 |
| Enkrypt AI - Risk Score | 32.8 | Risk Score | 48.9 |
| AidanBench | 926 | Novel Answers | 45.5 |
| OpenAI HumanEval | 82.93 | Accuracy (%) | 45.5 |
| Enkrypt AI - Insecure Code Risk | 45.78 | Risk Score | 30.1 |
| CyberSecEval2 Vulnerability Exploit | 38.11 | Accuracy (%) | 30 |
| Enkrypt AI - Jailbreak Risk | 11.84 | Risk Score | 29.2 |
Interactive version: theaggregate.ai/model?slug=mistral-large-latest · How It Works · Data refreshed daily, snapshot 2026-09-05.