ParseBench - Tables: leaderboard

Metric: GTRM Score (GriTS + TableRecordMatch). Source: parsebench.ai. Saturation forecast: Around December 2026. 78 models tracked.

Top models

#ModelScore
1Claude Opus 5.593.86
2Claude Fable 5.191.52
3Gemini 3 Flash (High)91.5
4Gemini 3.5 Flash (Medium)91.12
5Gemini 3.1 Pro (Preview)91
6GPT-6 Sol (Medium)90.27
7GPT-5.5 (Medium)90.05
8Gemini 3 Flash (Minimal)89.85
9Claude Fable 589.79
10Claude Opus 4.889.65
11GPT-6 Sol (Non-reasoning)89.49
12Gemini 3.6 Flash (Medium)89.47
13GPT-5.6 Sol (Non-reasoning)89.34
14GPT-5.5 (Non-reasoning)89.31
15GLM-5.3 Flash89.18

Interactive version: theaggregate.ai/benchmark?slug=parsebench-tables · How It Works · Data refreshed daily, snapshot 2026-09-24.