Claude Opus 4.8 (Medium) — benchmark results
Provider: Anthropic. Released 2026-05-29. Access: API.
Unified ELO 1909 ± 38, rank #50 of 1839 rated models, from 7 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| ARC-AGI-2 | 71.67 | Accuracy (%) | 89.3 |
| WeirdML | 76.04 | Average Score | 88 |
| ARC-AGI-1 | 91.5 | Accuracy (%) | 83.4 |
| LiveBench | 74.02 | LiveBench average (self-reported) | 54.8 |
| DeepResearchBench | 47.43 | Average Score | 42.9 |
| Epoch AI - Cursorbench | 56.6 | Score | 40 |
| DeepsecBench | 6.88 | Recall-weighted F2 score (%) | 20 |
Interactive version: theaggregate.ai/model?slug=claude-opus-4-8-medium · How It Works · Data refreshed daily, snapshot 2026-08-05.