Qwen 2.5 Coder 7B Instruct — benchmark results

Alibaba's Apache-2.0 7B code specialist launched with Qwen2.5-Coder in September 2024, trained on 5.5T code-heavy tokens with 128K context. Provider: Alibaba. Released 2024-09-19. Access: Open.

Unified ELO 1415 ± 29, rank #1153 of 1776 rated models, from 88 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Japanese LLM - Wikicorpus J TO E Bleu EN88.51Score (%)100
Open Japanese LLM - Xlsum JA Rouge281.43Score (%)99.3
Open Japanese LLM - Xlsum JA Bleu JA19.22Score (%)95
Open LLM Leaderboard - MATH Level 537.16Score87.5
GSM8K86.7Accuracy (%)86.7
Open Korean LLM Leaderboard489.69Average Score (%)86.4
Open LLM Leaderboard - IFEval61.47Score73.6
DuckDB-NSQL57.3Execution Accuracy (%)66.1
BigCodeBench40.4Pass@1 (%)59.9
Open Japanese LLM - Mbpp Pylint Check49.2Score (%)57.8
Open Japanese LLM - Wiki NER SET F16.19Score (%)57.2
CodeElo397Elo Rating55.9

Interactive version: theaggregate.ai/model?slug=qwen-2-5-coder-7b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.