Qwen 2.5 1.5B Instruct — benchmark results
Alibaba Qwen 2.5 1.5B instruction-tuned checkpoint. Provider: Alibaba. Released 2024-09-19. Access: Open.
Unified ELO 1366 ± 7, rank #1358 of 1776 rated models, from 506 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| OpenEval - Omni-MATH | 15.82 | Accuracy (%) | 75 |
| EuroEval English NLU - SQuAD | 83.18 | Reading comprehension Score (%) | 74.8 |
| Open LLM Leaderboard - MATH Level 5 | 22.05 | Score | 74.8 |
| LA Leaderboard - AQuAS | 66.64 | Accuracy (%) | 69.1 |
| OpenEval - BBQ | 68.67 | Exact Match (%) | 69 |
| OpenEval - IFEval Strict | 53.33 | Strict Accuracy (%) | 66.7 |
| EuroEval Polish NLU - PoQuAD | 48.29 | Reading comprehension Score (%) | 65.7 |
| Open Arabic LLM - Aratrust Offensive | 84.06 | Accuracy (%) | 63.4 |
| EuroEval Italian NLU - Sentipolc16 | 54.07 | Sentiment classification Score (%) | 60.3 |
| OpenEval - GPQA CoT | 26.68 | CoT Correctness (%) | 59.5 |
| EuroEval Slovak NLU - Multi Wiki QA SK | 60.47 | Reading comprehension Score (%) | 58.9 |
| EuroEval Spanish NLU - MLQA ES | 61.26 | Reading comprehension Score (%) | 58.6 |
Interactive version: theaggregate.ai/model?slug=qwen-2-5-1-5b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.