Qwen 2.5 1.5B: benchmark results

Provider: Alibaba. Released 2024-09-19. Access: Open.

Unified ELO 1378 ± 1, rank #1198 of 1392 rated models, from 211 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Arabic LLM - Arabic MMLU HT Abstract Algebra32Accuracy (%)66
Open Japanese LLM - Mbpp Pylint Check62.45Score (%)61.3
LA Leaderboard - AQuAS66.02Accuracy (%)58.8
Open Japanese LLM - CG23.69Score (%)58.3
Open Arabic LLM - Arabic MMLU Civics (High School)44.83Accuracy (%)56.5
LA Leaderboard - EusExams Basque30.98Accuracy (%)51.1
On Stable Long-Form Generation19.6LVC (self-reported)50
Open LLM Leaderboard - MATH Level 59.14Score44.7
Open Arabic LLM - Arabic MMLU HT High School Mathematics26.67Accuracy (%)40.4
Open LLM Leaderboard - GPQA4.7Score40.2
Open Arabic LLM - Arabic MMLU HT Moral Scenarios24.69Accuracy (%)39.2
Open Arabic LLM - Arabic MMLU HT Global Facts30Accuracy (%)37.7

Interactive version: theaggregate.ai/model?slug=qwen-2-5-1-5b · How It Works · Data refreshed daily, snapshot 2026-09-05.