Claude Opus 4 (High): benchmark results

Provider: Anthropic. Released 2025-05-22. Access: API.

Unified ELO 1613 ± 1, rank #550 of 3078 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HAL GAIA64.85Accuracy (%)81.2
HAL GAIA Level 267.44Accuracy (%)81.2
IKP - T397.27Accuracy (%)75.5
IKP - T299.5Accuracy (%)72.2
HAL GAIA Level 171.7Accuracy (%)71.9
IKP - T199.5Accuracy (%)58.5
IKP - T475Accuracy (%)48.7
Incompressible Knowledge Probes (IKP)61.06Mean tier accuracy (%)46.2
IKP - T539.78Accuracy (%)46
IKP - T612.3Accuracy (%)44.6
HAL TAU-bench Airline44Accuracy (%)42.9
HAL GAIA Level 342.31Accuracy (%)37.5

Interactive version: theaggregate.ai/model?slug=claude-opus-4-high · How It Works · Data refreshed daily, snapshot 2026-09-19.