Qwen 2.5 7B Instruct Turbo: benchmark results

Provider: Alibaba. Released 2024-09-19. Access: Open.

Unified ELO 1534 ± 1, rank #520 of 1392 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Enkrypt AI - Safety Risk17.33Risk Score93.5
Enkrypt AI - Bias Risk50.65Risk Score92.4
OpenEval - Omni-MATH29.4Accuracy (%)76.2
Judge Arena1280ELO Score70.4
OpenEval - MMLU-Pro CoT53.9CoT Correctness (%)69.6
OpenEval - GPQA CoT34.08CoT Correctness (%)68.2
OpenEval - IFEval Strict74.09Strict Accuracy (%)60.9
Enkrypt AI - Risk Score33Risk Score47.7
Enkrypt AI - Toxicity Risk4.36Risk Score41
Enkrypt AI - Insecure Code Risk42.67Risk Score33
Enkrypt AI - Jailbreak Risk14.21Risk Score24.4
Vals AI LegalBench69.56Accuracy (%)14.9

Interactive version: theaggregate.ai/model?slug=qwen-2-5-7b-instruct-turbo · How It Works · Data refreshed daily, snapshot 2026-09-05.