Claude Opus 4.5 (20251101): benchmark results
November 1, 2025 Claude Opus 4.5 snapshot, tracked when sources report the dated API model. Provider: Anthropic. Released 2025-11-01. Access: API.
Unified ELO 1683 ± 1, rank #80 of 1392 rated models, from 71 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Gorilla API Bench (BFCL) | 77.47 | Overall Accuracy (%) | 100 |
| Vals AI MGSM | 94.76 | Accuracy (%) | 98.9 |
| Chatbot Arena (Text - Longer Query) | 1493 | Arena Score | 95 |
| Chatbot Arena (Text - Coding) | 1523 | Arena Score | 94.8 |
| Chatbot Arena (Text - Instruction Following) | 1475 | Arena Score | 94.7 |
| Chatbot Arena (Text - Creative Writing) | 1461 | Arena Score | 94.2 |
| Chatbot Arena (Text - Korean) | 1447 | Arena Score | 94.1 |
| AraGen | 80.29 | 3C3H Score (%) | 94 |
| Chatbot Arena (Text - Multi-Turn) | 1484 | Arena Score | 93.7 |
| Chatbot Arena (Text - Hard Prompts) | 1498 | Arena Score | 93.5 |
| SEAL - SciPredict | 23.05 | Score | 92.9 |
| Chatbot Arena (Text - English) | 1479 | Arena Score | 92.1 |
Interactive version: theaggregate.ai/model?slug=claude-opus-4-5-20251101 · How It Works · Data refreshed daily, snapshot 2026-09-05.