Claude Haiku 4.5 (High): benchmark results

Provider: Anthropic. Released 2025-10-15. Access: API.

Unified ELO 1592 ± 1, rank #673 of 3078 rated models, from 20 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
IKP - T299.5Accuracy (%)72.2
InfiniteBM Heads-Up No-Limit Hold'em1256.09Arena Elo (elo)66.7
InfiniteBM Werewolf1159.65Arena Elo (elo)63.6
SWE-bench Verified66.6Resolved (%)63
SteerBench-Work - Pass^581.1Scenarios Correct in All 5 Trials (%)56.9
SteerBench-Work85.1Mean Trial Accuracy (%)48.3
HAL SWE-bench Verified Mini44Score (%)32.4
IKP - T383.61Accuracy (%)32.1
HAL ScienceAgentBench23.53Accuracy (%)30
IKP - T453.72Accuracy (%)30
Incompressible Knowledge Probes (IKP)50.83Mean tier accuracy (%)27.3
APEX-Agents21.4Mean Score (ReAct) (self-reported)25

Interactive version: theaggregate.ai/model?slug=claude-haiku-4-5-high · How It Works · Data refreshed daily, snapshot 2026-09-19.