DeepSeek V4 Pro (0813) (Reasoning, Max Effort): benchmark results

Provider: DeepSeek. Released 2026-08-13. Access: Open.

Unified ELO 1699 ± 1, rank #111 of 1761 rated models, from 34 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Software Engineering (SWE) - R64Accuracy (%)99.7
AA Omniscience - Software Engineering (SWE) - Go66Accuracy (%)99.5
AA Omniscience - Software Engineering (SWE) - PHP78Accuracy (%)99.1
AA Omniscience - Software Engineering (SWE) - TypeScript71.11Accuracy (%)99.1
AA Omniscience - Software Engineering (SWE) - Java49Accuracy (%)99
AA Omniscience - Software Engineering (SWE) - Julia52Accuracy (%)98.8
AA Omniscience - Software Engineering (SWE) - C77Accuracy (%)98.6
AA Omniscience - Software Engineering (SWE) - HTML74Accuracy (%)98.6
AA Omniscience - Software Engineering (SWE) - JavaScript66.36Accuracy (%)98.6
AA Omniscience - Software Engineering (SWE) - Python63.5Accuracy (%)98.3
AA Omniscience - Software Engineering (SWE) - Kotlin54Accuracy (%)98.1
AA Omniscience - Software Engineering (SWE) - Dart44Accuracy (%)97.8

Interactive version: theaggregate.ai/model?slug=deepseek-v4-pro-0813-reasoning-max-effort · How It Works · Data refreshed daily, snapshot 2026-09-05.