DeepSeek V4 Pro (0813) (Max): benchmark results

Provider: DeepSeek. Released 2026-08-13. Access: Open.

Unified ELO 1703 ± 1, rank #93 of 1761 rated models, from 33 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Vals AI SWE-bench Verified96.4Resolved (%)98.9
OTIS Mock AIME 2024-2598.61Accuracy (%)95.8
Chess Puzzles (Epoch AI)47Accuracy (%)94.5
Epoch AI - Mystery Game Puzzles43Score94.4
Vals AI Vibe Code Bench82.3Accuracy (%)92.3
Vals AI LiveCodeBench87.53Accuracy (%)91.5
SuperCLUE-Terminal - Overall51.52Score90
Vals AI GPQA92.42Accuracy (%)88.7
LLM2014 Logic 2026-0859.63Median Score84.1
FrontierMath - Tiers 1-3 (v2)64.56Accuracy (%, 285 private v2 problems)82.3
SimpleQA Verified52.91Accuracy (%)80.5
Epoch AI - Critpt18Score79.9

Interactive version: theaggregate.ai/model?slug=deepseek-v4-pro-0813-max · How It Works · Data refreshed daily, snapshot 2026-09-05.