deepseek-coder-33B-base: benchmark results

Provider: DeepSeek. Released 2023-10-28. Access: Open.

Unified ELO 1344 ± 1, rank #1280 of 1392 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SAFIM69.01Average100
BigCode Models Leaderboard52.5HumanEval Python Pass@1 (%)66.1
GSM8K35.4Accuracy (%)40.3
EvalPlus (HumanEval+ & MBPP+)44.5Pass@1 avg (%)37.1
EffiBench - NET3.14Normalized Execution Time26.8
ARC Challenge (AI2)42.2Accuracy (%)26.3
WinoGrande62Accuracy (%)16.2
MMLU39.4Accuracy (%)11.9
EffiBench - NMU2.08Normalized Memory Usage0

Interactive version: theaggregate.ai/model?slug=deepseek-coder-33b-base · How It Works · Data refreshed daily, snapshot 2026-09-05.