Qwen 2.5 0.5B Instruct: benchmark results

Alibaba Qwen 2.5 0.5B instruction-tuned checkpoint. Provider: Alibaba. Released 2024-09-19. Access: Open.

Unified ELO 1326 ± 1, rank #1310 of 1392 rated models, from 281 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MERA Code - CodeCorrectness82.73Accuracy (%)83.1
Open Arabic LLM - Arabic MMLU HT Machine Learning35.71Accuracy (%)50.6
MERA - ruHumanEval10.79pass@1 (%)48.6
Open LLM Leaderboard - MATH Level 510.35Score48.5
MERA - ruCodeEval7.56pass@1 (%)45.5
Open Arabic LLM - Arabic MMLU HT Formal Logic34.92Accuracy (%)43.5
Open Arabic LLM - Arabic MMLU Philosophy (High School)43.59Accuracy (%)34.6
MERA - LCS11Accuracy (%)34.2
MERA - RWSD52.69Accuracy (%)34.2
OpenEval - Omni-MATH9.43Accuracy (%)33.3
Open Arabic LLM - Arabic MMLU HT College Computer Science32Accuracy (%)33
Open Arabic LLM - Arabic MMLU HT College Physics24.51Accuracy (%)31.2

Interactive version: theaggregate.ai/model?slug=qwen-2-5-0-5b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.