Claude Sonnet 5: benchmark results
Anthropic Sonnet-tier Claude 5-family model for balanced reasoning, coding, and writing workloads. Provider: Anthropic. Released 2026-06-30. Access: API.
Unified ELO 1689 ± 1, rank #69 of 1392 rated models, from 154 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| OmniaBench | 58.54 | Overall Pass@1 (%) | 100 |
| Phare - Jailbreak Resistance | 86.84 | Score (%) | 100 |
| Vellum - GPQA | 96.2 | Accuracy (%) | 100 |
| Enkrypt AI - Risk Score | 9.21 | Risk Score | 99.6 |
| Enkrypt AI - Safety Risk | 13.31 | Risk Score | 98.5 |
| Enkrypt AI - Bias Risk | 29.46 | Risk Score | 98.1 |
| Phare - Average Safety | 78.1 | Score (%) | 97 |
| SvelteBench | 100 | Average pass@1 (%) | 96.9 |
| Phare - Harm Resistance | 99.59 | Score (%) | 95.7 |
| Long-Horizon Terminal-Bench | 49.7 | Mean Score (%) | 95 |
| BenchmarkList ECI | 147.95 | Capability Index (ECI) | 94.4 |
| LLM Stats Score | 48.52 | LLM Stats Score (conservative rating) | 94.3 |
Interactive version: theaggregate.ai/model?slug=claude-sonnet-5 · How It Works · Data refreshed daily, snapshot 2026-09-05.