DeepSeek V3 (March 2025): benchmark results

March 2025 DeepSeek V3 snapshot. Provider: DeepSeek. Released 2025-03-24. Access: Open.

Unified ELO 1684 ± 36, rank #359 of 2656 rated models, from 17 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SEAL - Agentic Tool Use (Enterprise)64.23Score69.7
SEAL - Agentic Tool Use (Chat)54.31Score54.5
Epoch AI - ECI135.95ECI Score51.5
HAL TAU-bench Airline44Accuracy (%)42.9
HAL SciCode3.08Accuracy (%)40
HAL Online Mind2Web32.33Accuracy (%)36.4
HAL USACO39.09Accuracy (%)36.4
HAL CORE-Bench Hard17.78Accuracy (%)25
HAL GAIA Level 231.97Accuracy (%)12.5
HAL SWE-bench Verified Mini24Score (%)11.8
SEAL - Humanity's Last Exam (Text Only)4.55Score10.5
HAL AssistantBench2.03Accuracy (%)7.1

Interactive version: theaggregate.ai/model?slug=deepseek-v3-march-2025 · How It Works · Data refreshed daily, snapshot 2026-09-19.