Qwen2.5-Math-7B-Instruct — benchmark results

Provider: Alibaba. Released 2024-09-19. Access: Open.

Unified ELO 1304 ± 28, rank #1523 of 1776 rated models, from 71 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 558.08Score99.6
Open Japanese LLM - ALT E TO J Bleu JA60.89Score (%)98.1
Open Japanese LLM - Xlsum JA Bleu JA14.76Score (%)94.7
Omni-MATH33.22Overall Accuracy (%)71.4
U-MATH - Sequences & Series51.95Accuracy (%)54.5
Open Japanese LLM - Jsick Exact Match78.71Score (%)51.7
U-MATH - Precalculus76.25Accuracy (%)51.5
U-MATH45.45Accuracy (%)45.5
Open Japanese LLM - MR76.6Score (%)43
U-MATH - Multivariable Calculus38.76Accuracy (%)42.4
U-MATH - Integral Calculus22.12Accuracy (%)36.4
Open Japanese LLM - CG1Score (%)34.1

Interactive version: theaggregate.ai/model?slug=qwen2-5-math-7b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.