Qwen 2.5 7B Instruct: benchmark results

Alibaba Qwen 2.5 7B instruction-tuned checkpoint. Provider: Alibaba. Released 2024-09-19. Access: Open.

Unified ELO 1452 ± 1, rank #933 of 1392 rated models, from 470 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 550Score97
LA Leaderboard - GalCoLA61.21Accuracy (%)95.6
Mobile-MMLU74.9Overall Accuracy (%)95.2
Open CoT - LSAT Analytical Reasoning9.13CoT Gain (%)94.3
Thai LLM NLU - wisesight_thai_sentiment_seacrowd_text52.86Accuracy (%)92.8
EVALITA - text-entailment83.65CPS91.5
Open LLM Leaderboard - IFEval75.85Score91.3
LA Leaderboard - AQuAS69.85Accuracy (%)89.7
Open CoT - LSAT Logical Reasoning19.22CoT Gain (%)89.7
Open Korean LLM Leaderboard44.66Average Score (%)89.7
EVALITA - summarization-fanpage30.79CPS89.4
Sahabat-AI - Indonesian (ID)59.2Score (%)87.5

Interactive version: theaggregate.ai/model?slug=qwen-2-5-7b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.