DeepSeek V3 (Dec '24): benchmark results

Provider: DeepSeek. Released 2024-12-26. Access: Open.

Unified ELO 1557 ± 1, rank #415 of 1392 rated models, from 20 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Humanities & Social Sciences27.1Accuracy (%)69.2
AA Omniscience - Law18.4Accuracy (%)68.7
AA Omniscience - Health25.5Accuracy (%)68.2
AA Omniscience - Business21.5Accuracy (%)67
AA-Omniscience Accuracy25.45Accuracy (%)64.9
AA Omniscience - Software Engineering (SWE)33.5Accuracy (%)64.1
AA Omniscience-41.65Score46.2
AA Omniscience - Science, Engineering & Mathematics26.7Accuracy (%)45.6
Artificial Analysis Intelligence Index8.27Intelligence Index43.2
AA Terminal-Bench Hard6.82Accuracy (%)37.1
AA Long Context Reasoning29.33Accuracy (%)31.7
AA GPQA Diamond55.66Accuracy (%)29.4

Interactive version: theaggregate.ai/model?slug=deepseek-v3-dec-24 · How It Works · Data refreshed daily, snapshot 2026-09-05.