Open LMM Reasoning - MathVista - TQA — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1Doubao-1.5-Pro79.1
2GPT-4.1 Mini77.8
3Gemini 2.0 Flash77.8
4GPT-4o ChatGPT77.2
5GPT-4.1 (2025-04-14)76.6
6InternVL2.5-78B75.9
7Gemini 1.5 Pro (002)75.3
8Claude 3.7 Sonnet74.7
9InternVL3-78B74.1
10Qwen 2 VL 72B74.1
11InternVL3-38B74.1
12Claude 3.5 Sonnet (20241022)74.1
13InternVL3-14B72.8
14Ovis2-8B72.2
15Gemma 3 27B70.9

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathvista-tqa · How the rankings work · Data refreshed daily, snapshot 2026-07-22.