Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort): benchmark results

Claude Sonnet 4.6 evaluated in adaptive-reasoning mode at max effort. Provider: Anthropic. Released 2026-02-17. Access: API.

Unified ELO 1652 ± 1, rank #239 of 1761 rated models, from 49 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Terminal-Bench Hard53.03Accuracy (%)96.2
AA Global-MMLU-Lite - Japanese92.58Accuracy (%)95.9
AA Global-MMLU-Lite - Portuguese92.5Accuracy (%)95.9
AA Global-MMLU-Lite - Bengali90.92Accuracy (%)95.5
AA Global-MMLU-Lite - Italian92.92Accuracy (%)95.5
UGI - Writing64.15Writing Score94.8
UGI Leaderboard52.82UGI Score94.3
AA Global-MMLU-Lite - Korean91.08Accuracy (%)93.7
UGI - Natural Intelligence58.7NatInt Score93.3
AA Global-MMLU-Lite90.48Accuracy (%)91.9
AA Global-MMLU-Lite - Arabic90.17Accuracy (%)91.9
AA Global-MMLU-Lite - Burmese88.17Accuracy (%)91.9

Interactive version: theaggregate.ai/model?slug=claude-sonnet-4-6-adaptive-reasoning-max-effort · How It Works · Data refreshed daily, snapshot 2026-09-05.