Qwen2.5-Math-7B-Instruct: benchmark results

Provider: Alibaba. Released 2024-09-19. Access: Open.

Unified ELO 1342 ± 1, rank #1281 of 1392 rated models, from 94 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 558.08Score99.6
Omni-MATH33.22Overall Accuracy (%)71.4
MERA - SimpleAr98.9EM (%)63.7
U-MATH - Sequences & Series51.95Accuracy (%)54.5
MERA - MathLogicQA47.86Accuracy (%)53.6
MERA - ruMultiAr32.32EM (%)53.1
Open Japanese LLM - Jsick Exact Match78.71Score (%)51.7
U-MATH - Precalculus76.25Accuracy (%)51.5
MERA - RWSD55.38Accuracy (%)45.7
U-MATH45.45Accuracy (%)45.5
MERA - ruModAr50.85EM (%)43.1
Open Japanese LLM - MR76.6Score (%)43

Interactive version: theaggregate.ai/model?slug=qwen2-5-math-7b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.