DeepSeek V4 Pro (Non-reasoning) — benchmark results

DeepSeek V4 Pro non-reasoning evaluation mode. Provider: DeepSeek. Released 2026-04-23. Access: Open.

Unified ELO 1728 ± 27, rank #224 of 1776 rated models, from 36 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI - Natural Intelligence59.21NatInt Score94.3
UGI - Writing60.25Writing Score93.7
UGI Leaderboard48.55UGI Score87.6
AA TAU-2 Bench91.23Accuracy (%)86.1
AA Omniscience - Software Engineering (SWE) - Java34Accuracy (%)83.5
AA Terminal-Bench Hard36.36Accuracy (%)83.3
AA Omniscience - Software Engineering (SWE) - PHP48Accuracy (%)82.7
AA Omniscience - Business28.2Accuracy (%)82.4
AA Omniscience - Software Engineering (SWE) - TypeScript47.78Accuracy (%)81.1
AA Omniscience - Humanities & Social Sciences31.1Accuracy (%)80.6
AA SciCode42.36Accuracy (%)80.4
AA-Omniscience Accuracy30.77Accuracy (%)80.4

Interactive version: theaggregate.ai/model?slug=deepseek-v4-pro-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.