Claude Opus 4.6 (High): benchmark results
Claude Opus 4.6 evaluated at the high reasoning-effort setting. Provider: Anthropic. Released 2026-02-05. Access: API.
Unified ELO 1718 ± 1, rank #66 of 1761 rated models, from 68 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| CTI-REALM | 0.64 | Normalized Reward | 100 |
| Chatbot Arena (Text - English) | 1514 | Arena Score | 100 |
| Chatbot Arena (Text - Instruction Following) | 1514 | Arena Score | 100 |
| Chatbot Arena (Text - Longer Query) | 1524 | Arena Score | 100 |
| DeepResearchBench | 55.3 | Average Score | 100 |
| Chatbot Arena (Text - Coding) | 1552 | Arena Score | 99.9 |
| Chatbot Arena (Text - Hard Prompts) | 1533 | Arena Score | 99.9 |
| Chatbot Arena (Text - Multi-Turn) | 1518 | Arena Score | 99.9 |
| Chatbot Arena (Text - Creative Writing) | 1500 | Arena Score | 99.7 |
| Chatbot Arena (Text - German) | 1510 | Arena Score | 99.7 |
| Chatbot Arena (Text) | 1505 | Elo | 99.7 |
| Chatbot Arena (Text - Math) | 1517 | Arena Score | 99 |
Interactive version: theaggregate.ai/model?slug=claude-opus-4-6-high · How It Works · Data refreshed daily, snapshot 2026-09-05.