TableVista: leaderboard

Metric: Avg. (self-reported). Source: benchmarklist.com. 29 models tracked.

Top models

#ModelScore
1GPT-5.472.1
2Llama 4 Maverick54.7
3Gemma 4 31B (IT)54.3
4Qwen 3.5 27B51.4
5Qwen 3.5 122B A10B51.1
6Llama 4 Scout49.4
7GPT-5.4 Mini49.4
8Qwen 3.6 35B A3B43.4
9Gemma 3 27B (IT)42.8
10Gemma 4 26B A4B (IT)42.5
11Qwen 3.5 9B40.7
12Qwen 3.5 35B A3B40
13Molmo2-8B39.9
14Gemma 3 12B (IT)38.5
15gemma-4-E4B-it27

Interactive version: theaggregate.ai/benchmark?slug=tablevista · How It Works · Data refreshed daily, snapshot 2026-09-05.