CodeQwen1.5-7B — benchmark results

Provider: Alibaba. Released 2024-04-16. Access: Open.

Unified ELO 1254 ± 20, rank #1608 of 1776 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ShaderMatch16.75Clone Match Rate (%)90.5
BigCode Models Leaderboard50.8HumanEval Python Pass@1 (%)60.2
Big Code Memorization - HumanEval pass@5038.84HumanEval pass@50 (%)58.8
Big Code Memorization - HumanEval-ET pass@5032.79HumanEval-ET pass@50 (%)58.8
EvalPlus (HumanEval+ & MBPP+)53.2Pass@1 avg (%)50
GSM8K37.7Accuracy (%)42.6
Big Code Memorization - HumanEval pass@143.9HumanEval pass@1 (%)41.2
Big Code Memorization - HumanEval-ET pass@138.41HumanEval-ET pass@1 (%)41.2
MMLU40.5Accuracy (%)12.6
ARC Challenge (AI2)35.7Accuracy (%)10.3
WinoGrande59.8Accuracy (%)10

Interactive version: theaggregate.ai/model?slug=codeqwen1-5-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.