Qwen2.5-Math-1.5B-Instruct: benchmark results

Provider: Alibaba. Released 2024-09-16. Access: Open.

Unified ELO 1305 ± 1, rank #1342 of 1392 rated models, from 31 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 526.28Score79.1
MERA - ruHumanEval15.98pass@1 (%)57.7
MERA - ruCodeEval15.12pass@1 (%)57.4
MERA - LCS13Accuracy (%)51.2
MERA - ruMultiAr30.08EM (%)46.9
MERA - ruModAr49.53EM (%)39
MERA - SimpleAr95.3EM (%)37
MERA - RWSD50.38Accuracy (%)21.8
Open LLM Leaderboard - BBH12.86Score21.7
MERA - MathLogicQA34.91Accuracy (%)21.5
ReliableMath - Prudence0Score (%)21.1
Open LLM Leaderboard - MMLU-Pro8.9Score19.5

Interactive version: theaggregate.ai/model?slug=qwen2-5-math-1-5b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.