DeepSeek V3.2 (Non-reasoning) — benchmark results

DeepSeek V3.2 evaluated with reasoning disabled. Provider: DeepSeek. Released 2025-12-01. Access: Open.

Unified ELO 1619 ± 25, rank #436 of 1776 rated models, from 80 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI Leaderboard55.75UGI Score96.6
UGI - Writing56.3Writing Score91.7
UGI - Natural Intelligence47.85NatInt Score90.1
AA MMLU-Pro83.71Accuracy (%)86.3
AA Omniscience - Software Engineering (SWE) - Kotlin34Accuracy (%)78.2
AA Terminal-Bench Hard32.58Accuracy (%)76.6
AA Omniscience - Software Engineering (SWE) - Dart32Accuracy (%)75.8
AA Omniscience - Software Engineering (SWE) - Go30Accuracy (%)74.3
UGI - Willingness (W/10)7.2W/10 Score73.6
AA Omniscience - Software Engineering (SWE) - C54Accuracy (%)73.5
AA Omniscience - Software Engineering (SWE) - R24Accuracy (%)72
AA Omniscience - Humanities & Social Sciences26.5Accuracy (%)71.7

Interactive version: theaggregate.ai/model?slug=deepseek-v3-2-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.