Claude Haiku 4.5 (Thinking) — benchmark results

Claude Haiku 4.5 evaluated with thinking enabled. Provider: Anthropic. Released 2025-10-01. Access: API.

Unified ELO 1665 ± 24, rank #332 of 1776 rated models, from 63 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Long Context Reasoning70.33Accuracy (%)93.7
AA Omniscience-4.22Score83.3
AA SciCode43.29Accuracy (%)82.6
AA AIME 202583.67Accuracy (%)80.4
AA Omniscience - Software Engineering (SWE) - Julia28Accuracy (%)75.6
Artificial Analysis Intelligence Index29.58Intelligence Index74.7
BenchTable61.3Total Score (%)72.7
AA Terminal-Bench Hard27.27Accuracy (%)69.3
AA Omniscience - Software Engineering (SWE) - Rust58Accuracy (%)68.8
AA Omniscience - Software Engineering (SWE) - HTML40Accuracy (%)67.5
AA LiveCodeBench61.48Pass@1 (%)67
YapBench335.2YapIndex (lower is better)66

Interactive version: theaggregate.ai/model?slug=claude-haiku-4-5-thinking · How the rankings work · Data refreshed daily, snapshot 2026-07-22.