MMTU - Table Matching — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 26 models tracked.

Top models

#ModelScore
1GPT-591.63
2O391.08
3GPT-5 Mini89.48
4Gemini 2.5 Flash88.87
5Grok 3 Mini88.82
6Gemini 2.5 Pro88.44
7GPT-5 Chat87.37
8DeepSeek R1 052886.04
9GPT-4o (2024-11-20)84.71
10Qwen 3 32B83.91
11Qwen 3 235B A22B 2507 Instruct83.68
12Mistral Large 2 (Nov) Instruct (2411)82.97
13Qwen 3 235B A22B (Thinking)82.88
14Qwen 3 8B82.03
15Llama 4 Maverick Instruct FP881.45

Interactive version: theaggregate.ai/benchmark?slug=mmtu-table-matching · How the rankings work · Data refreshed daily, snapshot 2026-07-22.