Claude Opus 4.5 (20251101) (Thinking, High): benchmark results

Provider: Anthropic. Released 2025-11-24. Access: API.

Unified ELO 1762 ± 27, rank #209 of 2136 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Vals AI SAGE52.09Accuracy (%)92.2
Vals AI Finance Agent58.81Accuracy (%)84.5
Vals AI TaxEval v274.86Accuracy (%)81.9
MedCode49.16Score (self-reported)81.1
Vals AI LegalBench84.6Accuracy (%)81.1
Vals AI MMLU-Pro87.26Accuracy (%)78.1
Vals AI MedCode49.16Accuracy (%)78.1
Vals AI MedScribe85.32Accuracy (%)74.8
Vals AI CorpFin v265.07Accuracy (%)74.4
ProofBench36Score (self-reported)70.7
Vals AI GPQA85.86Accuracy (%)67.9
Vals AI LiveCodeBench83.67Accuracy (%)67.6

Interactive version: theaggregate.ai/model?slug=claude-opus-4-5-20251101-thinking-high · How It Works · Data refreshed daily, snapshot 2026-10-10.