DeepSeek V3 (0324) — benchmark results

March 24, 2025 DeepSeek V3 snapshot row. Provider: DeepSeek. Released 2025-03-24. Access: Open.

Unified ELO 1591 ± 11, rank #499 of 1776 rated models, from 249 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AGC-Bench - pun_eval1.52Dataset z-score100
BenCzechMark86.4Average Score (%)100
SEA LLM Leaderboard - SeaExam80.8Private Average Score (%)98.3
UGI Leaderboard54.97UGI Score96.3
SEA LLM Leaderboard - SeaBench8.78Private Average Score (0-10)96.2
AGC-Bench - ocw1.57Dataset z-score95.1
AGC-Bench - story_generation_rocstories1.88Dataset z-score95.1
Polish EQ-Bench73.46EQ-Bench Score94.1
AGC-Bench - hypobench0.41Dataset z-score91.5
AGC-Bench - simile_generation0.94Dataset z-score91.2
CPTU Bench4.03Average Score (1-5)90.8
UGI - Natural Intelligence47.28NatInt Score89.7

Interactive version: theaggregate.ai/model?slug=deepseek-v3-0324 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.