Claude Opus 4.7 (High) — benchmark results

Claude Opus 4.7 evaluated at the high reasoning-effort setting. Provider: Anthropic. Released 2026-04-16. Access: API.

Unified ELO 1856 ± 23, rank #100 of 1776 rated models, from 39 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
OpenCompass Code - Comprehensive63.7Score (%)100
OpenCompass LLM - Code63.7Score (%)100
Finance Agent v1.164.37Score (self-reported)98.2
OpenCompass Reasoning - Academic50.9Score (%)95.5
Multi-turn Debate (Lechmazur)1684.7Bradley-Terry Rating95
WeirdML76.44Average Score92.7
FutureEval14.62Unified Forecasting Score91.9
OpenCompass LLM - Reasoning63.5Score (%)90.9
Epoch AI - ECI156.1ECI Score89.6
Vals Index66.1Score (self-reported)87.5
OpenCompass LLM - Knowledge92.2Score (%)86.4
Vals Multimodal Index67.36Score (self-reported)84.2

Interactive version: theaggregate.ai/model?slug=claude-opus-4-7-high · How the rankings work · Data refreshed daily, snapshot 2026-07-22.