Claude Opus 4.8 (Low) — benchmark results
Provider: Anthropic. Released 2026-05-29. Access: API.
Unified ELO 1901 ± 40, rank #64 of 1806 rated models, from 7 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| OTIS Mock AIME 2024-25 | 97.78 | Accuracy (%) | 93.6 |
| ARC-AGI-2 | 62.22 | Accuracy (%) | 81.2 |
| ARC-AGI-1 | 88 | Accuracy (%) | 78.4 |
| Chess Puzzles (Epoch AI) | 29 | Accuracy (%) | 71.1 |
| DeepResearchBench | 49.27 | Average Score | 60 |
| Epoch AI - Cursorbench | 54.3 | Score | 33.3 |
| LiveBench | 70.51 | LiveBench average (self-reported) | 26.2 |
Interactive version: theaggregate.ai/model?slug=claude-opus-4-8-low · How It Works · Data refreshed daily, snapshot 2026-08-07.