DeepSeek V3.1 Terminus (Non-reasoning) — benchmark results

Provider: DeepSeek. Released 2025-09-22. Access: Open.

Unified ELO 1608 ± 17, rank #476 of 1841 rated models, from 35 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA MMLU-Pro83.6Accuracy (%)84.9
AA Omniscience - Software Engineering (SWE) - Java28Accuracy (%)76.7
AA Omniscience - Software Engineering (SWE) - Go32Accuracy (%)75.9
AA Terminal-Bench Hard31.82Accuracy (%)75.3
AA Omniscience - Humanities & Social Sciences26.3Accuracy (%)70.5
AA Omniscience - Business21.1Accuracy (%)67.5
AA Omniscience - Law16.6Accuracy (%)67.3
AA Omniscience - Software Engineering (SWE) - R20Accuracy (%)66
AA Omniscience - Software Engineering (SWE) - Dart26Accuracy (%)65.5
AA Omniscience - Software Engineering (SWE) - Julia20Accuracy (%)64.8
AA Omniscience - Health22.3Accuracy (%)62.7
AA Omniscience - Software Engineering (SWE) - C45Accuracy (%)62.6

Interactive version: theaggregate.ai/model?slug=deepseek-v3-1-terminus-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-07-25.