Claude Opus 4.7 (High): benchmark results

Claude Opus 4.7 evaluated at the high reasoning-effort setting. Provider: Anthropic. Released 2026-04-16. Access: API.

Unified ELO 1705 ± 1, rank #90 of 1761 rated models, from 62 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Vals AI Finance Agent64.37Accuracy (%)100
Chatbot Arena (Text - Coding)1552Arena Score99.9
Chatbot Arena (Text - Spanish)1502Arena Score99.6
Chatbot Arena (Text - Instruction Following)1503Arena Score99.5
Chatbot Arena (Text - English)1509Arena Score99.4
Chatbot Arena (Text - Multi-Turn)1516Arena Score99.4
Chatbot Arena (Vision)1301Arena Score99.3
Chatbot Arena (Text - Hard Prompts)1526Arena Score99.2
Chatbot Arena (Text)1502Elo99.2
Chatbot Arena (Text - Longer Query)1515Arena Score99.1
Chatbot Arena (Text - Creative Writing)1489Arena Score99
Chatbot Arena (Vision - Diagram)1336Arena Score99

Interactive version: theaggregate.ai/model?slug=claude-opus-4-7-high · How It Works · Data refreshed daily, snapshot 2026-09-05.