Claude Opus 4.6 (Adaptive Reasoning, Max Effort) — benchmark results

Claude Opus 4.6 evaluated in adaptive-reasoning mode at max effort. Provider: Anthropic. Released 2026-02-05. Access: API.

Unified ELO 1878 ± 26, rank #82 of 1776 rated models, from 62 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Global-MMLU-Lite - Chinese93.58Accuracy (%)100
AA Global-MMLU-Lite - English95.17Accuracy (%)100
AA Global-MMLU-Lite - Korean93Accuracy (%)100
AA Omniscience - Software Engineering (SWE) - R74Accuracy (%)99.6
AA Global-MMLU-Lite - Bengali92.08Accuracy (%)99.2
AA Global-MMLU-Lite - German93.42Accuracy (%)99.2
AA Global-MMLU-Lite - Hindi91.92Accuracy (%)99.1
AA Global-MMLU-Lite - Portuguese93.92Accuracy (%)99.1
UGI - Writing70.7Writing Score99.1
AA Global-MMLU-Lite - Arabic92.25Accuracy (%)98.3
AA Global-MMLU-Lite - Italian93.83Accuracy (%)98.3
AA Global-MMLU-Lite - Japanese93.08Accuracy (%)98.3

Interactive version: theaggregate.ai/model?slug=claude-opus-4-6-adaptive-reasoning-max-effort · How the rankings work · Data refreshed daily, snapshot 2026-07-22.