Qwen 2.5 1.5B — benchmark results

Provider: Alibaba. Released 2024-09-19. Access: Open.

Unified ELO 1350 ± 12, rank #1411 of 1776 rated models, from 209 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Arabic LLM - Arabic MMLU HT Abstract Algebra32Accuracy (%)66
Open Japanese LLM - Mbpp Pylint Check62.45Score (%)61.3
LA Leaderboard - AQuAS66.02Accuracy (%)58.8
Open Japanese LLM - CG23.69Score (%)58.3
Open Arabic LLM - Arabic MMLU Civics (High School)44.83Accuracy (%)56.5
LA Leaderboard - EusExams Basque30.98Accuracy (%)51.1
Open LLM Leaderboard - MATH Level 59.14Score44.7
Open Arabic LLM - Arabic MMLU HT High School Mathematics26.67Accuracy (%)40.4
Open LLM Leaderboard - GPQA4.7Score40.2
Open Arabic LLM - Arabic MMLU HT Moral Scenarios24.69Accuracy (%)39.2
Open Arabic LLM - Arabic MMLU HT Global Facts30Accuracy (%)37.7
Open PL LLM - Multiple Choice27.24Average Multiple-Choice Score (%)35.3

Interactive version: theaggregate.ai/model?slug=qwen-2-5-1-5b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.