Claude 3.7 Sonnet (Non-reasoning): benchmark results

Claude 3.7 Sonnet evaluated with reasoning disabled. Provider: Anthropic. Released 2025-02-24. Access: API.

Unified ELO 1564 ± 1, rank #586 of 1761 rated models, from 20 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Law30.6Accuracy (%)81.5
AA Omniscience - Business28.2Accuracy (%)78.8
AA Omniscience-9.72Score73.4
AA Omniscience - Humanities & Social Sciences28.3Accuracy (%)71.7
AA-Omniscience Accuracy28.2Accuracy (%)70.8
Artificial Analysis Intelligence Index17.16Intelligence Index62.1
AA Terminal-Bench Hard21.21Accuracy (%)60.9
AA Omniscience - Software Engineering (SWE)31.1Accuracy (%)59.5
AA Omniscience - Health22.9Accuracy (%)59.4
AA TAU-2 Bench50Accuracy (%)52.8
AA Omniscience - Science, Engineering & Mathematics28.1Accuracy (%)51.2
AA IFBench44.01Accuracy (%)48.8

Interactive version: theaggregate.ai/model?slug=claude-3-7-sonnet-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.