DeepSeek V4 Pro (0813) (High): benchmark results
Provider: DeepSeek. Released 2026-08-13. Access: Open.
Unified ELO 1714 ± 1, rank #102 of 3078 rated models, from 11 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| WebDev Arena | 1581.64 | Arena Score | 88.1 |
| ObviousBench | 98.61 | Answer pass³ (%) | 86.9 |
| ARC-AGI-2 | 59.72 | Accuracy (%) | 73.5 |
| Multi-turn Debate (Lechmazur) | 1579.7 | Bradley-Terry Rating | 72.5 |
| ARC-AGI-1 | 87.17 | Accuracy (%) | 72 |
| Context Arena | 64.09 | Average Score (%) | 70.1 |
| AI Coding Daily (OpenCode) - Laravel Code Quality | 17.25 | Laravel Code Quality (max 20) points, LLM-judged rubric scor | 63.2 |
| Computer Anthology Terminal Tasks (Terminus-2) | 32.6 | pass@1 (%) | 55.6 |
| AI Coding Daily (OpenCode) - Total | 45.63 | Total points (max 60) | 47.4 |
| DuelLab Overall | 34.2 | DuelLab Score | 45.2 |
| AI Coding Daily (OpenCode) - React-TS Code Quality | 16.33 | React-TS Code Quality (max 20) points, LLM-judged rubric sco | 31.6 |
Interactive version: theaggregate.ai/model?slug=deepseek-v4-pro-0813-high · How It Works · Data refreshed daily, snapshot 2026-09-19.