Claude Opus 4.6 (Adaptive Reasoning, Max Effort): benchmark results

Claude Opus 4.6 evaluated in adaptive-reasoning mode at max effort. Provider: Anthropic. Released 2026-02-05. Access: API.

Unified ELO 1689 ± 1, rank #133 of 1761 rated models, from 68 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Global-MMLU-Lite - Chinese93.58Accuracy (%)100
AA Global-MMLU-Lite - English95.17Accuracy (%)100
AA Global-MMLU-Lite - Korean93Accuracy (%)100
AA Global-MMLU-Lite - Bengali92.08Accuracy (%)99.1
AA Global-MMLU-Lite - German93.42Accuracy (%)99.1
AA Global-MMLU-Lite - Hindi91.92Accuracy (%)99.1
AA Global-MMLU-Lite - Portuguese93.92Accuracy (%)99.1
UGI - Writing70.7Writing Score98.6
AA Global-MMLU-Lite92.15Accuracy (%)98.2
AA Global-MMLU-Lite - Arabic92.25Accuracy (%)98.2
AA Global-MMLU-Lite - Italian93.83Accuracy (%)98.2
AA Global-MMLU-Lite - Japanese93.08Accuracy (%)98.2

Interactive version: theaggregate.ai/model?slug=claude-opus-4-6-adaptive-reasoning-max-effort · How It Works · Data refreshed daily, snapshot 2026-09-05.