Claude 3.5 Sonnet (20240620): benchmark results
June 2024 Claude 3.5 Sonnet snapshot, kept separate from later Claude 3.5 Sonnet rows. Provider: Anthropic. Released 2024-06-20. Access: API.
Unified ELO 1599 ± 1, rank #269 of 1392 rated models, from 723 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Clembench Multimodal v1.6.5 | 80.77 | clemscore (self-reported) | 100 |
| HELM EWoK - Material Dynamics | 90.9 | EM | 100 |
| HELM EWoK - Material Properties | 93.95 | EM | 100 |
| HELM EWoK - Physical Relations | 83.61 | EM | 100 |
| HELM NaturalQuestions (Closed) | 50.16 | F1 (%) | 100 |
| HELM ThaiExam - IC | 87.37 | EM | 100 |
| HELM ThaiExam - ONET | 73.46 | EM | 100 |
| HELM ThaiExam - TGAT | 83.08 | EM | 100 |
| HELM ThaiExam - ThaiExam | 75.1 | EM | 100 |
| LLM Game Benchmark | 42.17 | Source Win Rate (self-reported) | 100 |
| MEGA-Bench Task - Autorater 3D Model Texturing | 85.7 | Task Score (%) | 100 |
| MEGA-Bench Task - COCO OOD Global Image Retrieval By Query Property | 86 | Task Score (%) | 100 |
Interactive version: theaggregate.ai/model?slug=claude-3-5-sonnet-20240620 · How It Works · Data refreshed daily, snapshot 2026-09-05.