Qwen 2.5 72B Instruct Turbo: benchmark results

Provider: Alibaba. Released 2024-09-19. Access: Open.

Unified ELO 1567 ± 1, rank #379 of 1392 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Enkrypt AI - Safety Risk13.47Risk Score98.1
Enkrypt AI - Bias Risk44.19Risk Score95.5
Enkrypt AI - Risk Score22.75Risk Score81.1
OpenEval - MMLU-Pro CoT63.1CoT Correctness (%)78.3
OpenEval - IFEval Strict80.62Strict Accuracy (%)69.6
Enkrypt AI - Toxicity Risk2.18Risk Score63.2
Judge Arena1269ELO Score63
Enkrypt AI - Jailbreak Risk7.37Risk Score60.1
Enkrypt AI - Insecure Code Risk30.22Risk Score51.3
Vals AI LegalBench79.4Accuracy (%)36.2
ForecastBench61.9Overall Score (higher is better)31.4
Vals AI MedQA77.39Accuracy (%)20.2

Interactive version: theaggregate.ai/model?slug=qwen-2-5-72b-instruct-turbo · How It Works · Data refreshed daily, snapshot 2026-09-05.