Claude 3.7 Sonnet (20250219) — benchmark results

February 19, 2025 Claude 3.7 Sonnet snapshot, tracked when sources report the dated API model. Provider: Anthropic. Released 2025-02-19. Access: API.

Unified ELO 1655 ± 9, rank #357 of 1776 rated models, from 207 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ChemBench65.83Overall Score (%)100
CyberSecEval2 Vulnerability Exploit56.82Accuracy (%)100
GDM InterCode CTF87.34Accuracy (%)100
Galileo Tool Tasks - BFCL v3 Multi-Turn Base Multi-Function92Accuracy (%)100
Galileo Tool Tasks - BFCL v3 Multi-Turn Composite96Accuracy (%)100
Galileo Tool Tasks - BFCL v3 Multi-Turn Long Context94Accuracy (%)100
Galileo Tool Tasks - BFCL v3 Multi-Turn Missing Parameter97Accuracy (%)100
Galileo Tool Tasks - Multi Turn95Accuracy (%)100
Galileo Tool Tasks - Single Turn96Accuracy (%)100
Galileo Tool Tasks - tau Long Context100Accuracy (%)100
Galileo Tool Tasks - xLAM Tool Missing96Accuracy (%)100
HELM MedHELM - SHC-BMT90EM100

Interactive version: theaggregate.ai/model?slug=claude-3-7-sonnet-20250219 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.