mistral-large-latest: benchmark results

Provider: Mistral. Released 2024-07-24. Access: Open.

Unified ELO 1538 ± 1, rank #498 of 1392 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Enkrypt AI - Bias Risk39.53Risk Score96.6
Enkrypt AI - Safety Risk20.03Risk Score84.5
GDM InterCode CTF65.82Accuracy (%)57.1
CyberSecEval2 Interpreter Abuse23.9Accuracy (%)55.6
CyberSecEval2 Prompt Injection28.88Accuracy (%)55.6
Arcadia CommonsenseQA83.62Accuracy (%)50
Enkrypt AI - Risk Score32.8Risk Score48.9
AidanBench926Novel Answers45.5
OpenAI HumanEval82.93Accuracy (%)45.5
Enkrypt AI - Insecure Code Risk45.78Risk Score30.1
CyberSecEval2 Vulnerability Exploit38.11Accuracy (%)30
Enkrypt AI - Jailbreak Risk11.84Risk Score29.2

Interactive version: theaggregate.ai/model?slug=mistral-large-latest · How It Works · Data refreshed daily, snapshot 2026-09-05.