Claude 3 Sonnet (20240229) — benchmark results
February 29, 2024 Claude 3 Sonnet snapshot, tracked separately from generic Claude 3 Sonnet rows. Provider: Anthropic. Released 2024-03-04. Access: API.
Unified ELO 1451 ± 24, rank #991 of 1776 rated models, from 94 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| LogicKor - Coding | 9.85 | Score (0-10) | 97.6 |
| LogicKor - Grammar | 8.28 | Score (0-10) | 95.6 |
| BiGGen-Bench | 4.01 | Average Score (1-5) | 94.1 |
| LogicKor - Understanding | 9.71 | Score (0-10) | 93.1 |
| HELM Safety Anthropic Red Team | 99.8 | LM Evaluated Safety score (%) | 91.9 |
| LogicKor - Writing | 9.42 | Score (0-10) | 91.2 |
| LogicKor - Single-Turn | 8.54 | Score (0-10) | 90.5 |
| HELM ThaiExam - TGAT | 73.85 | EM | 89 |
| LogicKor - Multi-Turn | 8.4 | Score (0-10) | 88.7 |
| LogicKor - Reasoning | 8.21 | Score (0-10) | 88.5 |
| HELM Finance - FinanceBench | 65 | Correct Answer | 88.1 |
| LogicKor | 8.38 | Score (0-10) | 87.8 |
Interactive version: theaggregate.ai/model?slug=claude-3-sonnet-20240229 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.