Claude Opus 4.6 (Medium) — benchmark results

Claude Opus 4.6 evaluated at the medium reasoning-effort setting. Provider: Anthropic. Released 2026-02-05. Access: API.

Unified ELO 2129 ± 131, rank #7 of 1776 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MageBench S11747Rating100
MageBench Season 11747Rating (self-reported)100
Chess Bench LLM1403Lichess Rating87.9
Epoch AI - ECI155.38ECI Score86.7
DeepResearchBench53.24Average Score85.7
InsanityBench10Total Score71.4
GIM1.09IRT ability (theta)68.9

Interactive version: theaggregate.ai/model?slug=claude-opus-4-6-medium · How the rankings work · Data refreshed daily, snapshot 2026-07-22.