DeepSeek V3 (0324): benchmark results

March 24, 2025 snapshot of DeepSeek's open V3 MoE chat model. Provider: DeepSeek. Released 2025-03-24. Access: Open.

Unified ELO 1571 ± 1, rank #358 of 1392 rated models, from 284 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AGC-Bench - pun_eval1.52Dataset z-score100
BenCzechMark83.39Average Score (%)100
SEA LLM Leaderboard - SeaExam80.8Private Average Score (%)98.3
MERA - ruDetox37.74Joint Score (%)96.2
SEA LLM Leaderboard - SeaBench8.78Private Average Score (0-10)96.2
UGI Leaderboard54.97UGI Score96.2
AGC-Bench - ocw1.57Dataset z-score95.1
AGC-Bench - story_generation_rocstories1.88Dataset z-score95.1
Polish EQ-Bench73.46EQ-Bench Score94.1
MERA - CheGeKa53.08F1 (%)93.3
AGC-Bench - hypobench0.41Dataset z-score91.5
AGC-Bench - simile_generation0.94Dataset z-score91.2

Interactive version: theaggregate.ai/model?slug=deepseek-v3-0324 · How It Works · Data refreshed daily, snapshot 2026-09-05.