OmniDocBench 1.5: leaderboard
Document-understanding benchmark covering OCR, layout parsing, tables, formulas, and information extraction across document types.
Metric: Score (%). Source: llm-stats.com. Status: saturation imminent. 18 models tracked.
Top models
| # | Model | Score |
|---|---|---|
| 1 | MiniMax-M3 | 91.6 |
| 2 | Qwen 3.7 Plus | 91.4 |
| 3 | Qwen 3.6 Plus | 91.2 |
| 4 | Qwen 3.8 27B | 91.1 |
| 5 | Qwen 3.6 35B A3B | 89.9 |
| 6 | Qwen 3.5 122B A10B | 89.8 |
| 7 | Qwen 3.5 35B A3B | 89.3 |
| 8 | GPT-5.4 | 89.1 |
| 9 | Qwen 3.5 27B | 88.9 |
| 10 | Kimi K2.5 | 88.8 |
| 11 | GPT-5.5 Instant | 87.5 |
| 12 | GPT-5.4 Mini | 87.37 |
| 13 | GPT-5.4 Nano | 75.81 |
| 14 | Muse Glimmer 30B | 75.8 |
| 15 | DiffusionGemma 26B-A4B | 31.9 |
Interactive version: theaggregate.ai/benchmark?slug=omnidocbench-1-5 · How It Works · Data refreshed daily, snapshot 2026-09-05.