Qwen2.5-Coder-1.5B: benchmark results

Provider: Alibaba. Released 2024-11-12. Access: Open.

Unified ELO 1337 ± 1, rank #1290 of 1392 rated models, from 28 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
GSM8K65.8Accuracy (%)67.7
MERA - ruHumanEval4.82pass@1 (%)36.5
MERA - SimpleAr94.9EM (%)36.1
MERA - BPS87.6Accuracy (%)33.2
ARC Challenge (AI2)45.2Accuracy (%)31.6
MERA - ruCodeEval1.95pass@1 (%)31.6
MERA - RWSD52.31Accuracy (%)30.4
MERA - ruModAr45.62EM (%)28.2
MERA - ruMultiAr23.14EM (%)27.5
MMLU53.6Accuracy (%)23
MERA - ruHateSpeech56.98Accuracy (%)22.4
MERA - MathLogicQA34.47Accuracy (%)21.1

Interactive version: theaggregate.ai/model?slug=qwen2-5-coder-1-5b · How It Works · Data refreshed daily, snapshot 2026-09-05.