DeepSeek Coder V2: benchmark results

DeepSeek's open MoE code model (236B total/21B active, 128K context, 338 languages) that rivaled GPT-4 Turbo on coding (June 2024). Provider: DeepSeek. Released 2024-06-17. Access: Open.

Unified ELO 1509 ± 1, rank #655 of 1392 rated models, from 25 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
OlympicArena29.31Overall Accuracy (%)88.9
BenchBench71.31Aggregate Score (%)74.3
WildBench47.4WB Score Task-Macro69.4
Web-Bench16.7Pass@1 (%)66
Omni-MATH25.78Overall Accuracy (%)35.7
BenchTable36Total Score (%)33.7
SciCode21.2Subproblem Resolve Rate (%)33.3
Chatbot Arena (Text - Coding)1342Arena Score33.1
Chatbot Arena (Text - Math)1272Arena Score31.4
Chatbot Arena (Text - Hard Prompts)1288Arena Score29.8
OJBench8.24Score (self-reported)29.4
Chatbot Arena (Text - Chinese)1291Arena Score27.2

Interactive version: theaggregate.ai/model?slug=deepseek-coder-v2 · How It Works · Data refreshed daily, snapshot 2026-09-05.