Claude Sonnet 4 (High): benchmark results

Provider: Anthropic. Released 2025-05-22. Access: API.

Unified ELO 1633 ± 1, rank #430 of 3078 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
IKP - T2100Accuracy (%)92.6
HAL Online Mind2Web39.33Accuracy (%)77.3
MCPMark28.35Pass@1 (%)65.8
ObviousBench95.83Answer pass³ (%)65.8
IKP - T199.5Accuracy (%)58.5
HAL CORE-Bench Hard33.33Accuracy (%)48.1
IKP - T470.21Accuracy (%)43.1
Incompressible Knowledge Probes (IKP)57.41Mean tier accuracy (%)42.4
IKP - T533.7Accuracy (%)41.6
IKP - T388.52Accuracy (%)39.5
IKP - T66.42Accuracy (%)28.9
IKP - T73.49Accuracy (%)21.3

Interactive version: theaggregate.ai/model?slug=claude-sonnet-4-high · How It Works · Data refreshed daily, snapshot 2026-09-19.