DeepSeek V3.2 Exp (Non-reasoning): benchmark results

DeepSeek V3.2 Exp evaluated with reasoning disabled. Provider: DeepSeek. Released 2025-09-29. Access: Open.

Unified ELO 1558 ± 1, rank #603 of 1761 rated models, from 39 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI Leaderboard54.67UGI Score96.1
UGI - Natural Intelligence47.5NatInt Score89.2
UGI - Writing51.04Writing Score88.6
AA Omniscience - Software Engineering (SWE) - Go32Accuracy (%)85.5
AA MMLU-Pro83.64Accuracy (%)84
AA Omniscience - Software Engineering (SWE) - R22Accuracy (%)81.4
AA Omniscience - Software Engineering (SWE) - Kotlin28Accuracy (%)80.5
AA Omniscience - Software Engineering (SWE) - Python29.5Accuracy (%)80.2
AA Omniscience - Software Engineering (SWE) - PHP34Accuracy (%)79.4
AA Omniscience - Software Engineering (SWE) - Java21Accuracy (%)77.3
AA Omniscience - Software Engineering (SWE) - Dart24Accuracy (%)72.2
AA Omniscience - Software Engineering (SWE) - C43Accuracy (%)70.8

Interactive version: theaggregate.ai/model?slug=deepseek-v3-2-exp-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.