Qwen 2.5 0.5B Instruct — benchmark results
Alibaba Qwen 2.5 0.5B instruction-tuned checkpoint. Provider: Alibaba. Released 2024-09-19. Access: Open.
Unified ELO 1286 ± 11, rank #1561 of 1776 rated models, from 240 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| OpenEval - Omni-MATH | 9.44 | Accuracy (%) | 60 |
| Open Arabic LLM - Arabic MMLU HT Machine Learning | 35.71 | Accuracy (%) | 50.6 |
| Open LLM Leaderboard - MATH Level 5 | 10.35 | Score | 48.5 |
| Open Korean LLM Leaderboard | 51.62 | Average Score (%) | 47 |
| OpenEval - IFEval Strict | 34.26 | Strict Accuracy (%) | 45.2 |
| Open Arabic LLM - Arabic MMLU HT Formal Logic | 34.92 | Accuracy (%) | 43.5 |
| OpenEval - GPQA CoT | 17.04 | CoT Correctness (%) | 41.7 |
| Open Arabic LLM - Arabic MMLU Philosophy (High School) | 43.59 | Accuracy (%) | 34.6 |
| OpenEval - MMLU-Pro CoT | 6.62 | CoT Correctness (%) | 33.3 |
| Open Arabic LLM - Arabic MMLU HT College Computer Science | 32 | Accuracy (%) | 33 |
| Open Arabic LLM - Arabic MMLU HT College Physics | 24.51 | Accuracy (%) | 31.2 |
| Open Arabic LLM - Alghafa Multiple Choice Facts Truefalse Balanced Task | 64 | Accuracy (%) | 30.6 |
Interactive version: theaggregate.ai/model?slug=qwen-2-5-0-5b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.