DeepSeek V3 (0324): benchmark results
March 24, 2025 snapshot of DeepSeek's open V3 MoE chat model. Provider: DeepSeek. Released 2025-03-24. Access: Open.
Unified ELO 1571 ± 1, rank #358 of 1392 rated models, from 284 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AGC-Bench - pun_eval | 1.52 | Dataset z-score | 100 |
| BenCzechMark | 83.39 | Average Score (%) | 100 |
| SEA LLM Leaderboard - SeaExam | 80.8 | Private Average Score (%) | 98.3 |
| MERA - ruDetox | 37.74 | Joint Score (%) | 96.2 |
| SEA LLM Leaderboard - SeaBench | 8.78 | Private Average Score (0-10) | 96.2 |
| UGI Leaderboard | 54.97 | UGI Score | 96.2 |
| AGC-Bench - ocw | 1.57 | Dataset z-score | 95.1 |
| AGC-Bench - story_generation_rocstories | 1.88 | Dataset z-score | 95.1 |
| Polish EQ-Bench | 73.46 | EQ-Bench Score | 94.1 |
| MERA - CheGeKa | 53.08 | F1 (%) | 93.3 |
| AGC-Bench - hypobench | 0.41 | Dataset z-score | 91.5 |
| AGC-Bench - simile_generation | 0.94 | Dataset z-score | 91.2 |
Interactive version: theaggregate.ai/model?slug=deepseek-v3-0324 · How It Works · Data refreshed daily, snapshot 2026-09-05.