Qwen 2.5 Coder 7B Instruct — benchmark results
Alibaba's Apache-2.0 7B code specialist launched with Qwen2.5-Coder in September 2024, trained on 5.5T code-heavy tokens with 128K context. Provider: Alibaba. Released 2024-09-19. Access: Open.
Unified ELO 1415 ± 29, rank #1153 of 1776 rated models, from 88 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Japanese LLM - Wikicorpus J TO E Bleu EN | 88.51 | Score (%) | 100 |
| Open Japanese LLM - Xlsum JA Rouge2 | 81.43 | Score (%) | 99.3 |
| Open Japanese LLM - Xlsum JA Bleu JA | 19.22 | Score (%) | 95 |
| Open LLM Leaderboard - MATH Level 5 | 37.16 | Score | 87.5 |
| GSM8K | 86.7 | Accuracy (%) | 86.7 |
| Open Korean LLM Leaderboard | 489.69 | Average Score (%) | 86.4 |
| Open LLM Leaderboard - IFEval | 61.47 | Score | 73.6 |
| DuckDB-NSQL | 57.3 | Execution Accuracy (%) | 66.1 |
| BigCodeBench | 40.4 | Pass@1 (%) | 59.9 |
| Open Japanese LLM - Mbpp Pylint Check | 49.2 | Score (%) | 57.8 |
| Open Japanese LLM - Wiki NER SET F1 | 6.19 | Score (%) | 57.2 |
| CodeElo | 397 | Elo Rating | 55.9 |
Interactive version: theaggregate.ai/model?slug=qwen-2-5-coder-7b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.