deepseek-coder-33B-base — benchmark results

Provider: DeepSeek. Released 2023-10-28. Access: Open.

Unified ELO 1277 ± 27, rank #1579 of 1776 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SAFIM69.01Average100
BigCode Models Leaderboard52.5HumanEval Python Pass@1 (%)66.1
InfiBench38.75Score (%)52.4
GSM8K35.4Accuracy (%)39.9
EvalPlus (HumanEval+ & MBPP+)44.5Pass@1 avg (%)37.1
EffiBench - NET3.14Normalized Execution Time26.8
ARC Challenge (AI2)42.2Accuracy (%)25.6
WinoGrande62Accuracy (%)16.2
MMLU39.4Accuracy (%)11.9
Epoch AI - ECI95.86ECI Score3
EffiBench - NMU2.08Normalized Memory Usage0

Interactive version: theaggregate.ai/model?slug=deepseek-coder-33b-base · How the rankings work · Data refreshed daily, snapshot 2026-07-22.