Claude Opus 4.8 (Medium) — benchmark results

Provider: Anthropic. Released 2026-05-29. Access: API.

Unified ELO 1909 ± 38, rank #50 of 1839 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ARC-AGI-271.67Accuracy (%)89.3
WeirdML76.04Average Score88
ARC-AGI-191.5Accuracy (%)83.4
LiveBench74.02LiveBench average (self-reported)54.8
DeepResearchBench47.43Average Score42.9
Epoch AI - Cursorbench56.6Score40
DeepsecBench6.88Recall-weighted F2 score (%)20

Interactive version: theaggregate.ai/model?slug=claude-opus-4-8-medium · How It Works · Data refreshed daily, snapshot 2026-08-05.