Qwen 2.5 1.5B Instruct: benchmark results

Alibaba Qwen 2.5 1.5B instruction-tuned checkpoint. Provider: Alibaba. Released 2024-09-19. Access: Open.

Unified ELO 1403 ± 1, rank #1123 of 1392 rated models, from 574 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MERA Code - CodeCorrectness83.69Accuracy (%)86.2
EuroEval English NLU - SQuAD83.18Reading comprehension Score (%)74.8
Open LLM Leaderboard - MATH Level 522.05Score74.7
LA Leaderboard - AQuAS66.64Accuracy (%)69.1
EuroEval Polish NLU - PoQuAD48.29Reading comprehension Score (%)65.7
Open Arabic LLM - Aratrust Offensive84.06Accuracy (%)63.4
EuroEval Italian NLU - Sentipolc1654.07Sentiment classification Score (%)60.3
EuroEval Slovak NLU - Multi Wiki QA SK60.47Reading comprehension Score (%)58.9
EuroEval Spanish NLU - MLQA ES61.26Reading comprehension Score (%)58.6
EuroEval Spanish NLU - Sentiment Headlines ES42.07Sentiment classification Score (%)58.5
OpenEval - Omni-MATH15.8Accuracy (%)57.1
Enkrypt AI - Safety Risk24.61Risk Score56.5

Interactive version: theaggregate.ai/model?slug=qwen-2-5-1-5b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.