Qwen 2.5 1.5B Instruct: benchmark results
Alibaba Qwen 2.5 1.5B instruction-tuned checkpoint. Provider: Alibaba. Released 2024-09-19. Access: Open.
Unified ELO 1403 ± 1, rank #1123 of 1392 rated models, from 574 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MERA Code - CodeCorrectness | 83.69 | Accuracy (%) | 86.2 |
| EuroEval English NLU - SQuAD | 83.18 | Reading comprehension Score (%) | 74.8 |
| Open LLM Leaderboard - MATH Level 5 | 22.05 | Score | 74.7 |
| LA Leaderboard - AQuAS | 66.64 | Accuracy (%) | 69.1 |
| EuroEval Polish NLU - PoQuAD | 48.29 | Reading comprehension Score (%) | 65.7 |
| Open Arabic LLM - Aratrust Offensive | 84.06 | Accuracy (%) | 63.4 |
| EuroEval Italian NLU - Sentipolc16 | 54.07 | Sentiment classification Score (%) | 60.3 |
| EuroEval Slovak NLU - Multi Wiki QA SK | 60.47 | Reading comprehension Score (%) | 58.9 |
| EuroEval Spanish NLU - MLQA ES | 61.26 | Reading comprehension Score (%) | 58.6 |
| EuroEval Spanish NLU - Sentiment Headlines ES | 42.07 | Sentiment classification Score (%) | 58.5 |
| OpenEval - Omni-MATH | 15.8 | Accuracy (%) | 57.1 |
| Enkrypt AI - Safety Risk | 24.61 | Risk Score | 56.5 |
Interactive version: theaggregate.ai/model?slug=qwen-2-5-1-5b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.