ParseBench — leaderboard

Enterprise document parsing benchmark over tables, charts, layout, and content faithfulness for multimodal extraction systems.

Metric: Overall Score. Source: parsebench.ai. Status: saturation imminent. 50 models tracked.

Top models

#ModelScore
1Claude Fable 570.78
2Gemini 3.1 Pro (Preview)69.14
3GPT-5.567.76
4GPT-5.6 Terra64.17
5Claude Opus 4.863.7
6Claude Opus 4.763.34
7Gemma 4 31B (IT)62.4
8GPT-5.462.23
9Claude Sonnet 562.13
10GPT-5.6 Sol62.12
11Qwen 3 VL 8B Instruct61.97
12Gemma 4 26B A4B (IT)58.5
13Gemini 3.1 Flash Lite58.32
14GPT-5.6 Luna56.32
15Claude Opus 4.654.07

Interactive version: theaggregate.ai/benchmark?slug=parsebench · How the rankings work · Data refreshed daily, snapshot 2026-07-22.