Claude Sonnet 5 (High): benchmark results
Claude Sonnet 5 evaluated at the high reasoning-effort setting. Provider: Anthropic. Released 2026-06-30. Access: API.
Unified ELO 1668 ± 1, rank #186 of 1761 rated models, from 52 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Agent Arena - Steerability | 12.29 | Steerability (%) | 96.5 |
| Chatbot Arena (Text - Coding) | 1521 | Arena Score | 94 |
| LisanBench | 0.37 | Mean Path Length / Current Maximum | 93.5 |
| Chatbot Arena (Text - German) | 1477 | Arena Score | 92.7 |
| Chatbot Arena (Text - Instruction Following) | 1465 | Arena Score | 91.9 |
| Chatbot Arena (Text - Longer Query) | 1482 | Arena Score | 90.8 |
| Chatbot Arena (Text - Math) | 1474 | Arena Score | 90.2 |
| Chatbot Arena (Text - Hard Prompts) | 1490 | Arena Score | 90 |
| Chatbot Arena (Text - Russian) | 1472 | Arena Score | 89.9 |
| Chatbot Arena (Text - English) | 1474 | Arena Score | 89.7 |
| Chatbot Arena (Text) | 1462 | Elo | 88.2 |
| Chatbot Arena (Text - Japanese) | 1447 | Arena Score | 87.9 |
Interactive version: theaggregate.ai/model?slug=claude-sonnet-5-high · How It Works · Data refreshed daily, snapshot 2026-09-05.