Claude Opus 4.5 (20251101): benchmark results

November 1, 2025 Claude Opus 4.5 snapshot, tracked when sources report the dated API model. Provider: Anthropic. Released 2025-11-01. Access: API.

Unified ELO 1683 ± 1, rank #80 of 1392 rated models, from 71 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Gorilla API Bench (BFCL)77.47Overall Accuracy (%)100
Vals AI MGSM94.76Accuracy (%)98.9
Chatbot Arena (Text - Longer Query)1493Arena Score95
Chatbot Arena (Text - Coding)1523Arena Score94.8
Chatbot Arena (Text - Instruction Following)1475Arena Score94.7
Chatbot Arena (Text - Creative Writing)1461Arena Score94.2
Chatbot Arena (Text - Korean)1447Arena Score94.1
AraGen80.293C3H Score (%)94
Chatbot Arena (Text - Multi-Turn)1484Arena Score93.7
Chatbot Arena (Text - Hard Prompts)1498Arena Score93.5
SEAL - SciPredict23.05Score92.9
Chatbot Arena (Text - English)1479Arena Score92.1

Interactive version: theaggregate.ai/model?slug=claude-opus-4-5-20251101 · How It Works · Data refreshed daily, snapshot 2026-09-05.