DeepSeek Coder V2 — benchmark results

DeepSeek's open MoE code model (236B total/21B active, 128K context, 338 languages) that rivaled GPT-4 Turbo on coding (June 2024). Provider: DeepSeek. Released 2024-06-17. Access: Open.

Unified ELO 1571 ± 17, rank #561 of 1776 rated models, from 28 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LiveBench Math Comp50Score97.2
LiveBench Olympiad64.61Score94.4
LiveBench AMPS Hard43Score93.1
LiveBench Zebra Puzzle42Score91.7
OlympicArena29.31Overall Accuracy (%)88.9
LiveBench Table Join30.76Score87.5
LiveBench Web Of Lies V256Score83.3
LLM2014 Logic 2024-0658.35Score (%)82.8
LiveBench LCB Generation40Score82.6
LiveBench Coding Completion42.1Score81.2
LLM2014 Logic 2024-0758.41Score (%)80.8
LiveBench Story Generation75.33Score80.6

Interactive version: theaggregate.ai/model?slug=deepseek-coder-v2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.