Qwen 2.5 72B Instruct Turbo: benchmark results
Provider: Alibaba. Released 2024-09-19. Access: Open.
Unified ELO 1567 ± 1, rank #379 of 1392 rated models, from 12 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Enkrypt AI - Safety Risk | 13.47 | Risk Score | 98.1 |
| Enkrypt AI - Bias Risk | 44.19 | Risk Score | 95.5 |
| Enkrypt AI - Risk Score | 22.75 | Risk Score | 81.1 |
| OpenEval - MMLU-Pro CoT | 63.1 | CoT Correctness (%) | 78.3 |
| OpenEval - IFEval Strict | 80.62 | Strict Accuracy (%) | 69.6 |
| Enkrypt AI - Toxicity Risk | 2.18 | Risk Score | 63.2 |
| Judge Arena | 1269 | ELO Score | 63 |
| Enkrypt AI - Jailbreak Risk | 7.37 | Risk Score | 60.1 |
| Enkrypt AI - Insecure Code Risk | 30.22 | Risk Score | 51.3 |
| Vals AI LegalBench | 79.4 | Accuracy (%) | 36.2 |
| ForecastBench | 61.9 | Overall Score (higher is better) | 31.4 |
| Vals AI MedQA | 77.39 | Accuracy (%) | 20.2 |
Interactive version: theaggregate.ai/model?slug=qwen-2-5-72b-instruct-turbo · How It Works · Data refreshed daily, snapshot 2026-09-05.