DeepSeek V4 Flash (Non-reasoning) — benchmark results

DeepSeek V4 Flash non-reasoning evaluation mode. Provider: DeepSeek. Released 2026-04-23. Access: Open.

Unified ELO 1707 ± 36, rank #262 of 1776 rated models, from 36 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI Leaderboard59.21UGI Score98.5
AA TAU-2 Bench94.44Accuracy (%)92.9
UGI - Writing54.58Writing Score91.3
UGI - Natural Intelligence47.94NatInt Score90.3
AA Terminal-Bench Hard34.09Accuracy (%)78.8
AA Omniscience - Software Engineering (SWE) - Kotlin32Accuracy (%)76.1
AA Omniscience - Software Engineering (SWE) - Dart32Accuracy (%)75.8
AA Omniscience - Software Engineering (SWE) - C56Accuracy (%)75.7
AA Omniscience - Law20Accuracy (%)75.2
AA Omniscience - Software Engineering (SWE) - JavaScript42.73Accuracy (%)74.7
AA Omniscience - Business23.1Accuracy (%)74.4
AA Omniscience - Software Engineering (SWE) - Go30Accuracy (%)74.3

Interactive version: theaggregate.ai/model?slug=deepseek-v4-flash-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.