DeepSeek V4 Pro (Reasoning, Max Effort): benchmark results

DeepSeek V4 Pro reasoning max-effort evaluation mode. Provider: DeepSeek. Released 2026-04-23. Access: Open.

Unified ELO 1664 ± 1, rank #201 of 1761 rated models, from 78 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Qwen3.7 Launch - CritPT12.9Score (%)100
Qwen3.7 Launch - LiveCodeBench93.5Score (%)100
Qwen3.7 Launch - Vitabench51.9Score (%)100
AA Omniscience - Software Engineering (SWE) - PHP64Accuracy (%)97.6
AA Omniscience - Software Engineering (SWE) - C74Accuracy (%)97.3
AA Omniscience - Software Engineering (SWE) - Java39.39Accuracy (%)97.3
AA Omniscience - Software Engineering (SWE) - JavaScript57.27Accuracy (%)96.9
AA TAU-2 Bench96.2Accuracy (%)96.8
AA Omniscience - Software Engineering (SWE) - TypeScript57.78Accuracy (%)96.6
AA Omniscience - Software Engineering (SWE) - Dart42Accuracy (%)96.4
AA Omniscience - Software Engineering (SWE) - Rust75Accuracy (%)95.9
AA Omniscience - Software Engineering (SWE) - Go46Accuracy (%)95.6

Interactive version: theaggregate.ai/model?slug=deepseek-v4-pro-reasoning-max-effort · How It Works · Data refreshed daily, snapshot 2026-09-05.