DeepSeek V4 Pro (Reasoning): benchmark results

Provider: DeepSeek. Released 2026-04-23. Access: Open.

Unified ELO 1680 ± 1, rank #156 of 1761 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI Leaderboard62.26UGI Score99.1
UGI - Writing68.4Writing Score97.7
UGI - Natural Intelligence67.03NatInt Score96.6
Wolfram LLM Benchmarking Project62.7Correct Functionality (%)91.4
AtmosCoder-Bench93.3Accuracy (%, mean of 3 runs)80
GRIPS92.9Accuracy (%)76.9
GRIPS-hard67.3Accuracy (%)76.9
SpeechMap Compliance64.8% Requests Completed54.7
UGI - Willingness (W/10)3.2W/10 Score24.6

Interactive version: theaggregate.ai/model?slug=deepseek-v4-pro-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.