DeepSeek V3.2 Exp (Non-reasoning) — benchmark results

DeepSeek V3.2 Exp evaluated with reasoning disabled. Provider: DeepSeek. Released 2025-09-29. Access: Open.

Unified ELO 1637 ± 18, rank #396 of 1776 rated models, from 39 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI Leaderboard54.67UGI Score96.2
UGI - Natural Intelligence47.5NatInt Score89.9
UGI - Writing51.04Writing Score89.3
AA MMLU-Pro83.64Accuracy (%)85.5
AA CritPt1.43Accuracy (%)75.1
AA Omniscience - Software Engineering (SWE) - Go30Accuracy (%)74.3
AA SciCode39.93Accuracy (%)73.1
AA Omniscience - Humanities & Social Sciences26Accuracy (%)70.3
AA Omniscience - Software Engineering (SWE) - Python30Accuracy (%)69.4
AA Omniscience - Software Engineering (SWE) - Kotlin26Accuracy (%)68.5
AA Omniscience - Software Engineering (SWE) - R20Accuracy (%)66.6
AA Omniscience - Law15.7Accuracy (%)66.4

Interactive version: theaggregate.ai/model?slug=deepseek-v3-2-exp-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.