DeepSeek V3.2: benchmark results

DeepSeek's open V3.2, a 671B sparse MoE (37B active) continuing the V3 line's sparse-attention efficiency (December 2025). Provider: DeepSeek. Released 2025-12-01. Access: Open.

Unified ELO 1622 ± 1, rank #197 of 1392 rated models, from 482 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AJ-Bench77.34Overall Avg@3 (%)100
Chinese Classical Bench - Compress Efficiency16.32Score (%)100
LegalBench-RU - Reasoning91Accuracy (%)100
AGC-Bench - slang_generation1.26Dataset z-score98.8
WebArena74.3Success Rate (%)97.8
RAI-Bench - Refusal Rate (General)84Rate (%)96.2
Nejumi 4 - ALT - Bias96.57Score (%)95.9
GR-Ben55.4Average (self-reported)95.2
AGC-Bench - scar0.97Dataset z-score95.1
Chinese Classical Bench - Idiom-Source Book EM74Score (%)94.4
LLM Arena RU1133Arena Elo94.2
RewardBench 2 Focus92.63Accuracy (%)94.1

Interactive version: theaggregate.ai/model?slug=deepseek-v3-2 · How It Works · Data refreshed daily, snapshot 2026-09-05.