DeepSeek V4 Flash (Non-reasoning): benchmark results

DeepSeek V4 Flash non-reasoning evaluation mode. Provider: DeepSeek. Released 2026-04-23. Access: Open.

Unified ELO 1600 ± 1, rank #436 of 1761 rated models, from 38 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI Leaderboard59.21UGI Score98.5
AA TAU-2 Bench94.44Accuracy (%)92.9
UGI - Writing54.58Writing Score90.6
UGI - Natural Intelligence47.94NatInt Score89.6
AA Omniscience - Software Engineering (SWE) - Go34.69Accuracy (%)88.7
AA Omniscience - Software Engineering (SWE) - Kotlin34.69Accuracy (%)88.7
AA Omniscience - Software Engineering (SWE) - Dart32.65Accuracy (%)88.6
AA Omniscience - Software Engineering (SWE) - C55Accuracy (%)86.7
AA Omniscience - Software Engineering (SWE) - JavaScript42.86Accuracy (%)86
AA Omniscience - Software Engineering (SWE) - HTML47.92Accuracy (%)84.3
AA Omniscience - Software Engineering (SWE) - Julia25Accuracy (%)82.8
AA Omniscience - Software Engineering (SWE) - TypeScript36.67Accuracy (%)82.4

Interactive version: theaggregate.ai/model?slug=deepseek-v4-flash-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.