Qwen 2.5 1.5B Instruct — benchmark results

Alibaba Qwen 2.5 1.5B instruction-tuned checkpoint. Provider: Alibaba. Released 2024-09-19. Access: Open.

Unified ELO 1366 ± 7, rank #1358 of 1776 rated models, from 506 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
OpenEval - Omni-MATH15.82Accuracy (%)75
EuroEval English NLU - SQuAD83.18Reading comprehension Score (%)74.8
Open LLM Leaderboard - MATH Level 522.05Score74.8
LA Leaderboard - AQuAS66.64Accuracy (%)69.1
OpenEval - BBQ68.67Exact Match (%)69
OpenEval - IFEval Strict53.33Strict Accuracy (%)66.7
EuroEval Polish NLU - PoQuAD48.29Reading comprehension Score (%)65.7
Open Arabic LLM - Aratrust Offensive84.06Accuracy (%)63.4
EuroEval Italian NLU - Sentipolc1654.07Sentiment classification Score (%)60.3
OpenEval - GPQA CoT26.68CoT Correctness (%)59.5
EuroEval Slovak NLU - Multi Wiki QA SK60.47Reading comprehension Score (%)58.9
EuroEval Spanish NLU - MLQA ES61.26Reading comprehension Score (%)58.6

Interactive version: theaggregate.ai/model?slug=qwen-2-5-1-5b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.