Claude Opus 4.5 (Non-reasoning) — benchmark results
Claude Opus 4.5 evaluated with reasoning disabled. Provider: Anthropic. Released 2025-11-24. Access: API.
Unified ELO 1797 ± 28, rank #143 of 1776 rated models, from 58 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AA MMLU-Pro | 88.92 | Accuracy (%) | 98.8 |
| AA Global-MMLU-Lite - Korean | 92.25 | Accuracy (%) | 98.3 |
| AA Omniscience - Software Engineering (SWE) - Swift | 84 | Accuracy (%) | 98.1 |
| AA Global-MMLU-Lite - English | 94.17 | Accuracy (%) | 97.5 |
| AA Global-MMLU-Lite - Hindi | 91.08 | Accuracy (%) | 97 |
| AA Global-MMLU-Lite - Spanish | 93.83 | Accuracy (%) | 96.6 |
| AA Global-MMLU-Lite - Arabic | 90.92 | Accuracy (%) | 95.8 |
| AA Omniscience - Software Engineering (SWE) - R | 60 | Accuracy (%) | 94.4 |
| AA Omniscience - Software Engineering (SWE) - PHP | 74 | Accuracy (%) | 94.2 |
| AA Global-MMLU-Lite - Indonesian | 92 | Accuracy (%) | 94 |
| AA Global-MMLU-Lite - Japanese | 91.67 | Accuracy (%) | 93.9 |
| AA Omniscience - Software Engineering (SWE) - Rust | 78 | Accuracy (%) | 93.9 |
Interactive version: theaggregate.ai/model?slug=claude-opus-4-5-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.