Claude Opus 5 (Max): benchmark results

Provider: Anthropic. Released 2026-07-24. Access: API.

Unified ELO 1771 ± 1, rank #21 of 1919 rated models, from 105 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Agent Arena - Bash Recovery15.69Bash Recovery (%)100
Chatbot Arena (Text - Chinese)1569Arena Score100
Conceptual Reasoning Index - Argument Evaluation (LMCA)63.3Chance-Corrected Score (0-100)100
LiveBench AMPS Hard99.01Score100
RSI-Exam0.46Mean hidden-set score100
Toolathlon80.6Score (self-reported)100
Vals AI MedCode63.57Accuracy (%)100
Vals AI Public Benefits Bench76.93Accuracy (%)100
Vals AI Time Horizon Index13.67Progress (%)100
Chatbot Arena (Text - Math)1529Arena Score99.9
Chatbot Arena (Text - Korean)1501Arena Score99.8
Epoch AI - Dtbench97.6Score99.4

Interactive version: theaggregate.ai/model?slug=claude-opus-5-max · How It Works · Data refreshed daily, snapshot 2026-09-08.