Claude Opus 5 (Medium): benchmark results

Provider: Anthropic. Released 2026-07-24. Access: API.

Unified ELO 1751 ± 1, rank #28 of 1761 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Korean LLM Eval - CLIcK95.84Accuracy (%, 0-shot)100
Korean LLM Eval - HAE-RAE Bench95.84Accuracy (%, 0-shot)100
Korean LLM Eval - KMMLU-HARD88.4Accuracy (%, 0-shot)100
Korean LLM Eval - KMMLU-Pro95.64Accuracy (%, 0-shot)100
Korean LLM Eval - KoBALT-70088.14Accuracy (%, 0-shot)100
Korean LLM Eval - MuSR (Ko)86.53Accuracy (%, 0-shot)100
DuelLab Overall73.5DuelLab Score97.3
LisanBench0.53Mean Path Length / Current Maximum94.8
DataBench83Score (%)93.5
Epoch AI - Critpt26.86Score90.5
DeepsecBench28.25Recall-weighted F2 score (%)88.6
CursorBench 3.164.3Score (%)71.2

Interactive version: theaggregate.ai/model?slug=claude-opus-5-medium · How It Works · Data refreshed daily, snapshot 2026-09-05.