DeepSeek V3 (0324) — benchmark results
March 24, 2025 DeepSeek V3 snapshot row. Provider: DeepSeek. Released 2025-03-24. Access: Open.
Unified ELO 1591 ± 11, rank #499 of 1776 rated models, from 249 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AGC-Bench - pun_eval | 1.52 | Dataset z-score | 100 |
| BenCzechMark | 86.4 | Average Score (%) | 100 |
| SEA LLM Leaderboard - SeaExam | 80.8 | Private Average Score (%) | 98.3 |
| UGI Leaderboard | 54.97 | UGI Score | 96.3 |
| SEA LLM Leaderboard - SeaBench | 8.78 | Private Average Score (0-10) | 96.2 |
| AGC-Bench - ocw | 1.57 | Dataset z-score | 95.1 |
| AGC-Bench - story_generation_rocstories | 1.88 | Dataset z-score | 95.1 |
| Polish EQ-Bench | 73.46 | EQ-Bench Score | 94.1 |
| AGC-Bench - hypobench | 0.41 | Dataset z-score | 91.5 |
| AGC-Bench - simile_generation | 0.94 | Dataset z-score | 91.2 |
| CPTU Bench | 4.03 | Average Score (1-5) | 90.8 |
| UGI - Natural Intelligence | 47.28 | NatInt Score | 89.7 |
Interactive version: theaggregate.ai/model?slug=deepseek-v3-0324 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.