Qwen 2.5 0.5B Instruct — benchmark results

Alibaba Qwen 2.5 0.5B instruction-tuned checkpoint. Provider: Alibaba. Released 2024-09-19. Access: Open.

Unified ELO 1286 ± 11, rank #1561 of 1776 rated models, from 240 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
OpenEval - Omni-MATH9.44Accuracy (%)60
Open Arabic LLM - Arabic MMLU HT Machine Learning35.71Accuracy (%)50.6
Open LLM Leaderboard - MATH Level 510.35Score48.5
Open Korean LLM Leaderboard51.62Average Score (%)47
OpenEval - IFEval Strict34.26Strict Accuracy (%)45.2
Open Arabic LLM - Arabic MMLU HT Formal Logic34.92Accuracy (%)43.5
OpenEval - GPQA CoT17.04CoT Correctness (%)41.7
Open Arabic LLM - Arabic MMLU Philosophy (High School)43.59Accuracy (%)34.6
OpenEval - MMLU-Pro CoT6.62CoT Correctness (%)33.3
Open Arabic LLM - Arabic MMLU HT College Computer Science32Accuracy (%)33
Open Arabic LLM - Arabic MMLU HT College Physics24.51Accuracy (%)31.2
Open Arabic LLM - Alghafa Multiple Choice Facts Truefalse Balanced Task64Accuracy (%)30.6

Interactive version: theaggregate.ai/model?slug=qwen-2-5-0-5b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.