Claude Sonnet 5 (Medium): benchmark results
Provider: Anthropic. Released 2026-06-30. Access: API.
Unified ELO 1628 ± 1, rank #328 of 1761 rated models, from 12 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Korean LLM Eval - KMMLU-Pro | 85.83 | Accuracy (%, 0-shot) | 71.4 |
| Korean LLM Eval - CLIcK | 92.08 | Accuracy (%, 0-shot) | 57.1 |
| Korean LLM Eval - KMMLU-HARD | 77.44 | Accuracy (%, 0-shot) | 57.1 |
| Surface Evolver Bench | 60 | Mean Score (%) | 56 |
| DuelLab Overall | 40.9 | DuelLab Score | 51.4 |
| Korean LLM Eval - KoBALT-700 | 76.14 | Accuracy (%, 0-shot) | 42.9 |
| Korean LLM Eval - MuSR (Ko) | 81.6 | Accuracy (%, 0-shot) | 42.9 |
| Surface Evolver Bench Pass Rate | 18.75 | Pass Rate (%) | 32 |
| Korean LLM Eval - HAE-RAE Bench | 92 | Accuracy (%, 0-shot) | 28.6 |
| CursorBench 3.1 | 52.4 | Score (%) | 24.7 |
| DeepsecBench | 5.81 | Recall-weighted F2 score (%) | 11.4 |
| DataBench | 56 | Score (%) | 9.7 |
Interactive version: theaggregate.ai/model?slug=claude-sonnet-5-medium · How It Works · Data refreshed daily, snapshot 2026-09-05.