Qwen 2.5 Coder 7B Instruct: benchmark results

Alibaba's Apache-2.0 7B code specialist launched with Qwen2.5-Coder in September 2024, trained on 5.5T code-heavy tokens with 128K context. Provider: Alibaba. Released 2024-09-19. Access: Open.

Unified ELO 1449 ± 1, rank #948 of 1392 rated models, from 108 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
GSM8K86.7Accuracy (%)87.6
Open LLM Leaderboard - MATH Level 537.16Score87.5
MERA - RCB58.45Accuracy (%)84.2
MERA - BPS99.4Accuracy (%)84.1
Open Korean LLM Leaderboard41Average Score (%)77.6
Open LLM Leaderboard - IFEval61.47Score73.6
DuckDB-NSQL57.3Execution Accuracy (%)66.1
MERA - ruCodeEval20.67pass@1 (%)64.1
MERA - ruHateSpeech78.11Accuracy (%)60.1
BigCodeBench40.4Pass@1 (%)59.9
MERA - ruHumanEval17.32pass@1 (%)58.7
Open Japanese LLM - Mbpp Pylint Check49.2Score (%)57.8

Interactive version: theaggregate.ai/model?slug=qwen-2-5-coder-7b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.