Claude Opus 4.7 (Adaptive Reasoning, Max Effort) — benchmark results

Claude Opus 4.7 evaluated in adaptive-reasoning mode at max effort. Provider: Anthropic. Released 2026-04-16. Access: API.

Unified ELO 1936 ± 35, rank #45 of 1776 rated models, from 41 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience26.17Score99.1
AA Omniscience - Software Engineering (SWE) - Julia76Accuracy (%)98.3
Artificial Analysis Intelligence Index53.53Intelligence Index98.2
AA Omniscience - Software Engineering (SWE) - Swift84Accuracy (%)98.1
AA SciCode54.51Accuracy (%)97.4
AA Omniscience - Software Engineering (SWE) - Go78Accuracy (%)97.3
AA Omniscience - Software Engineering (SWE) - Java62Accuracy (%)96.9
AA Omniscience - Software Engineering (SWE) - Dart66Accuracy (%)96.5
AA Omniscience - Software Engineering (SWE) - Kotlin70Accuracy (%)96.4
AA GPQA Diamond91.41Accuracy (%)96.3
AA Humanity's Last Exam39.62Accuracy (%)96.1
AA Omniscience - Software Engineering (SWE)72Accuracy (%)95.8

Interactive version: theaggregate.ai/model?slug=claude-opus-4-7-adaptive-reasoning-max-effort · How the rankings work · Data refreshed daily, snapshot 2026-07-22.