Qwen2.5-7B-Instruct-1M: benchmark results
Provider: Alibaba. Access: Open.
Unified ELO 1481 ± 1, rank #781 of 1392 rated models, from 64 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - MATH Level 5 | 43.35 | Score | 92.4 |
| Open LLM Leaderboard - IFEval | 74.48 | Score | 89.6 |
| Open Japanese LLM - Jsick Exact Match | 84.29 | Score (%) | 87.7 |
| Open Japanese LLM - Wiki PAS SET F1 | 8.44 | Score (%) | 81 |
| RULER | 91.8 | Avg Accuracy (%) | 80 |
| Enkrypt AI - Safety Risk | 21.86 | Risk Score | 74.8 |
| Open LLM Leaderboard - BBH | 35.03 | Score | 70.5 |
| Open Japanese LLM - Jamp Exact Match | 65.23 | Score (%) | 64.8 |
| Open Japanese LLM - RC | 90.74 | Score (%) | 63 |
| Enkrypt AI - Insecure Code Risk | 24 | Risk Score | 59.8 |
| Open Japanese LLM - Jnli Exact Match | 82.54 | Score (%) | 58.7 |
| Open Japanese LLM - Jsts Spearman | 85.71 | Score (%) | 53.6 |
Interactive version: theaggregate.ai/model?slug=qwen2-5-7b-instruct-1m · How It Works · Data refreshed daily, snapshot 2026-09-05.