Claude Opus 5 (Medium): benchmark results
Provider: Anthropic. Released 2026-07-24. Access: API.
Unified ELO 1751 ± 1, rank #28 of 1761 rated models, from 13 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Korean LLM Eval - CLIcK | 95.84 | Accuracy (%, 0-shot) | 100 |
| Korean LLM Eval - HAE-RAE Bench | 95.84 | Accuracy (%, 0-shot) | 100 |
| Korean LLM Eval - KMMLU-HARD | 88.4 | Accuracy (%, 0-shot) | 100 |
| Korean LLM Eval - KMMLU-Pro | 95.64 | Accuracy (%, 0-shot) | 100 |
| Korean LLM Eval - KoBALT-700 | 88.14 | Accuracy (%, 0-shot) | 100 |
| Korean LLM Eval - MuSR (Ko) | 86.53 | Accuracy (%, 0-shot) | 100 |
| DuelLab Overall | 73.5 | DuelLab Score | 97.3 |
| LisanBench | 0.53 | Mean Path Length / Current Maximum | 94.8 |
| DataBench | 83 | Score (%) | 93.5 |
| Epoch AI - Critpt | 26.86 | Score | 90.5 |
| DeepsecBench | 28.25 | Recall-weighted F2 score (%) | 88.6 |
| CursorBench 3.1 | 64.3 | Score (%) | 71.2 |
Interactive version: theaggregate.ai/model?slug=claude-opus-5-medium · How It Works · Data refreshed daily, snapshot 2026-09-05.