Qwen 2.5 7B Instruct — benchmark results

Alibaba Qwen 2.5 7B instruction-tuned checkpoint. Provider: Alibaba. Released 2024-09-19. Access: Open.

Unified ELO 1455 ± 8, rank #971 of 1776 rated models, from 393 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 550Score97
LA Leaderboard - GalCoLA61.21Accuracy (%)95.6
Mobile-MMLU74.9Overall Accuracy (%)95.2
Open Korean LLM Leaderboard659.84Average Score (%)95
Open CoT - LSAT Analytical Reasoning9.13CoT Gain (%)94.3
EVALITA - text-entailment83.65CPS91.5
Open LLM Leaderboard - IFEval75.85Score91.3
LA Leaderboard - AQuAS69.85Accuracy (%)89.7
Open CoT - LSAT Logical Reasoning19.22CoT Gain (%)89.7
EVALITA - summarization-fanpage30.79CPS89.4
Sahabat-AI - Indonesian (ID)59.2Score (%)87.5
SeaEval - Multilingual Reasoning - ZBench (Zero-Shot)66.67Accuracy (%)85.4

Interactive version: theaggregate.ai/model?slug=qwen-2-5-7b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.