Claude 3 Haiku (20240307): benchmark results
March 7, 2024 Claude 3 Haiku snapshot, tracked separately from generic Claude 3 Haiku rows. Provider: Anthropic. Released 2024-03-07. Access: API.
Unified ELO 1455 ± 1, rank #920 of 1392 rated models, from 117 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| HELM Safety Anthropic Red Team | 100 | LM Evaluated Safety score (%) | 100 |
| BiGGen-Bench | 3.95 | Average Score (1-5) | 92.2 |
| LogicKor - Grammar | 8.07 | Score (0-10) | 91.6 |
| LogicKor - Understanding | 9.64 | Score (0-10) | 89.9 |
| Enkrypt AI - Toxicity Risk | 0.55 | Risk Score | 87.8 |
| Enkrypt AI - Safety Risk | 19.5 | Risk Score | 87.4 |
| HELM Safety SimpleSafetyTests | 100 | LM Evaluated Safety score (%) | 86 |
| LogicKor - Multi-Turn | 8.35 | Score (0-10) | 85.7 |
| LogicKor - Reasoning | 8.07 | Score (0-10) | 85.3 |
| LogicKor | 8.26 | Score (0-10) | 84.9 |
| LogicKor - Single-Turn | 8.4 | Score (0-10) | 84.9 |
| LogicKor - Coding | 9.28 | Score (0-10) | 84.5 |
Interactive version: theaggregate.ai/model?slug=claude-3-haiku-20240307 · How It Works · Data refreshed daily, snapshot 2026-09-05.