DeepSeek V4 Pro (Non-reasoning): benchmark results

DeepSeek V4 Pro non-reasoning evaluation mode. Provider: DeepSeek. Released 2026-04-23. Access: Open.

Unified ELO 1609 ± 1, rank #390 of 1761 rated models, from 42 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Software Engineering (SWE) - Java36Accuracy (%)95.7
AA Omniscience - Software Engineering (SWE) - PHP50Accuracy (%)93.9
UGI - Natural Intelligence59.21NatInt Score93.6
UGI - Writing60.25Writing Score93
AA Omniscience - Software Engineering (SWE) - TypeScript47.78Accuracy (%)92
AA Omniscience - Software Engineering (SWE) - C59Accuracy (%)89.6
AA Omniscience - Software Engineering (SWE) - JavaScript46.36Accuracy (%)88.4
AA Omniscience - Software Engineering (SWE) - Go34Accuracy (%)88.1
UGI Leaderboard48.55UGI Score87.6
AA Omniscience - Software Engineering (SWE) - Kotlin32Accuracy (%)86.5
AA TAU-2 Bench91.23Accuracy (%)86.1
AA Omniscience - Software Engineering (SWE) - Python33Accuracy (%)84.3

Interactive version: theaggregate.ai/model?slug=deepseek-v4-pro-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.