Qwen 2.5 0.5B — benchmark results
Alibaba Qwen 2.5 0.5B model row. Provider: Alibaba. Released 2024-09-19. Access: Open.
Unified ELO 1292 ± 14, rank #1547 of 1776 rated models, from 199 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Arabic LLM - Arabic MMLU Civics (High School) | 44.83 | Accuracy (%) | 56.5 |
| Open Japanese LLM - CG | 2.41 | Score (%) | 41 |
| Open Japanese LLM - Mbpp Pylint Check | 8.43 | Score (%) | 38 |
| Open Japanese LLM - Xlsum JA Bert Score JA F1 | 67.54 | Score (%) | 31 |
| Open Japanese LLM - Xlsum JA Rouge1 | 20.76 | Score (%) | 28.4 |
| Open Japanese LLM - Xlsum JA RougeLsum | 17.84 | Score (%) | 28 |
| Open Arabic LLM - Arabic MMLU HT Machine Learning | 31.25 | Accuracy (%) | 27.2 |
| Open Japanese LLM - SUM | 7.47 | Score (%) | 27.2 |
| Open Arabic LLM - Arabic MMLU Islamic Studies | 30.99 | Accuracy (%) | 25.6 |
| Open Japanese LLM - Xlsum JA Rouge2 | 7.48 | Score (%) | 25.5 |
| Open LLM Leaderboard - MATH Level 5 | 3.93 | Score | 22.6 |
| Open Arabic LLM - Arabic MMLU History (High School) | 32.5 | Accuracy (%) | 22.2 |
Interactive version: theaggregate.ai/model?slug=qwen-2-5-0-5b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.