ParseBench - Charts: leaderboard

Metric: ChartDataPointMatch Score. Source: parsebench.ai. Saturation forecast: Around February 2028. 78 models tracked.

Top models

#ModelScore
1Claude Fable 5.167.06
2GPT-5.5 (Medium)65.53
3GPT-5.4 (Non-reasoning)65.22
4Gemini 3 Flash (Minimal)64.83
5Gemini 3 Flash (High)64.79
6Claude Opus 5.564.12
7GPT-5.6 Terra (Non-reasoning)63.75
8Claude Sonnet 560.53
9GPT-5.6 Sol (Non-reasoning)59.57
10GPT-5.5 (Non-reasoning)59.11
11Claude Opus 4.755.84
12GLM-5.3 Flash54.96
13Claude Fable 552.21
14DeepSeek V4.1 Flash (High)51.11
15Claude Opus 4.849.75

Interactive version: theaggregate.ai/benchmark?slug=parsebench-charts · How It Works · Data refreshed daily, snapshot 2026-09-24.