Claude Haiku 4.5: benchmark results
Anthropic Haiku-tier Claude model for fast, cost-efficient tasks. Provider: Anthropic. Released 2025-10-01. Access: API.
Unified ELO 1603 ± 1, rank #254 of 1392 rated models, from 596 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Boiling the Frog | 20.5 | Strict ASR (self-reported) | 100 |
| DABstep | 89.95 | Hard Level Accuracy (%) | 100 |
| DystopiaBench | 23.8 | Dystopian Compliance Score (0-100) | 100 |
| LiveSecBench | 91.43 | Overall Score (%) | 100 |
| MT-JailBench | 18.24 | CrescendoX ASR (self-reported) | 100 |
| NRT-Bench | 8.7 | Aggregate ASR (self-reported) | 100 |
| Nejumi 4 - ALT - Toxicity | 88.21 | Score (%) | 100 |
| Phare - Average Safety | 83.16 | Score (%) | 100 |
| RealityTest | 92.3 | Text disclosure probability (self-reported) | 100 |
| SWE-PRBench | 15.3 | Overall (sbar) (self-reported) | 100 |
| gwBenchmarks | 59.31 | Waveform (self-reported) | 100 |
| RAI-Bench - RAG Robustness (LC Abstention) | 97 | Rate (%) | 99.3 |
Interactive version: theaggregate.ai/model?slug=claude-haiku-4-5 · How It Works · Data refreshed daily, snapshot 2026-09-05.