Claude Opus 4.7 — benchmark results

Anthropic's flagship Opus model for complex reasoning, coding, and writing tasks. Provider: Anthropic. Released 2026-04-16. Access: API.

Unified ELO 1893 ± 9, rank #67 of 1776 rated models, from 697 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AGC-Bench0.8Mean JRT z-score100
AGC-Bench - Humor1.09JRT z-score100
AGC-Bench - c3_crosstalk2.02Dataset z-score100
AGC-Bench - crowd_vote1.52Dataset z-score100
AGC-Bench - fig_qa2.5Dataset z-score100
AGC-Bench - grapheval_review_advisor1.77Dataset z-score100
AGC-Bench - metaphoric_analogies3.98Dataset z-score100
ASCIIBench1701ELO Rating100
AcuityBench85.3QA Exact (self-reported)100
Arena AI Code1570Arena ELO (self-reported)100
CVerifBench98.3Total (self-reported)100
CharXiv Reasoning (Anthropic No Tools)81.3Accuracy (%)100

Interactive version: theaggregate.ai/model?slug=claude-opus-4-7 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.