Claude Haiku 4.5 (High): benchmark results
Provider: Anthropic. Released 2025-10-15. Access: API.
Unified ELO 1592 ± 1, rank #673 of 3078 rated models, from 20 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| IKP - T2 | 99.5 | Accuracy (%) | 72.2 |
| InfiniteBM Heads-Up No-Limit Hold'em | 1256.09 | Arena Elo (elo) | 66.7 |
| InfiniteBM Werewolf | 1159.65 | Arena Elo (elo) | 63.6 |
| SWE-bench Verified | 66.6 | Resolved (%) | 63 |
| SteerBench-Work - Pass^5 | 81.1 | Scenarios Correct in All 5 Trials (%) | 56.9 |
| SteerBench-Work | 85.1 | Mean Trial Accuracy (%) | 48.3 |
| HAL SWE-bench Verified Mini | 44 | Score (%) | 32.4 |
| IKP - T3 | 83.61 | Accuracy (%) | 32.1 |
| HAL ScienceAgentBench | 23.53 | Accuracy (%) | 30 |
| IKP - T4 | 53.72 | Accuracy (%) | 30 |
| Incompressible Knowledge Probes (IKP) | 50.83 | Mean tier accuracy (%) | 27.3 |
| APEX-Agents | 21.4 | Mean Score (ReAct) (self-reported) | 25 |
Interactive version: theaggregate.ai/model?slug=claude-haiku-4-5-high · How It Works · Data refreshed daily, snapshot 2026-09-19.