Claude Haiku 4.5 (Thinking): benchmark results

Claude Haiku 4.5 evaluated with thinking enabled. Provider: Anthropic. Released 2025-10-01. Access: API.

Unified ELO 1554 ± 1, rank #616 of 1761 rated models, from 66 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Software Engineering (SWE) - Julia24Accuracy (%)80.2
AA AIME 202583.67Accuracy (%)79.8
AA Omniscience - Software Engineering (SWE) - HTML42Accuracy (%)78.3
AA Omniscience-4.37Score77.3
AA Long Context Reasoning74.33Accuracy (%)76.6
AA-LCR73.67Accuracy (self-reported)75.4
AA Omniscience - Software Engineering (SWE) - Rust56Accuracy (%)74.1
AA Omniscience - Software Engineering (SWE) - C44Accuracy (%)73.4
BenchTable61.3Total Score (%)72.7
AA Omniscience - Software Engineering (SWE) - R16Accuracy (%)72.5
AA Omniscience - Software Engineering (SWE) - Dart24Accuracy (%)72.2
AA Omniscience - Software Engineering (SWE) - JavaScript34.55Accuracy (%)72

Interactive version: theaggregate.ai/model?slug=claude-haiku-4-5-thinking · How It Works · Data refreshed daily, snapshot 2026-09-05.