DeepSeek V3.1 (Non-reasoning): benchmark results

DeepSeek V3.1 evaluated with reasoning disabled. Provider: DeepSeek. Released 2025-08-21. Access: Open.

Unified ELO 1547 ± 1, rank #646 of 1761 rated models, from 23 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI Leaderboard51.4UGI Score92.2
UGI - Writing51.06Writing Score88.7
UGI - Natural Intelligence45.29NatInt Score88.3
AA Terminal-Bench Hard24.24Accuracy (%)64.5
AA Omniscience - Humanities & Social Sciences25.45Accuracy (%)64.1
AA Omniscience - Law16.42Accuracy (%)63.5
AA Omniscience - Business19.82Accuracy (%)61
AA Omniscience - Software Engineering (SWE)32.2Accuracy (%)61
Artificial Analysis Intelligence Index14.82Intelligence Index57.8
AA-Omniscience Accuracy23.13Accuracy (%)57.3
AA GPQA Diamond73.54Accuracy (%)54.2
AA Omniscience - Health19.7Accuracy (%)46.6

Interactive version: theaggregate.ai/model?slug=deepseek-v3-1-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.