OpenVLM MathVista - TQA — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1GPT-5 (2025-08-07)84.8
2Gemini 2.5 Pro83.5
3GPT-5 Nano80.4
4GPT-5 Mini (2025-08-07)80.4
5GPT-4.1 Mini77.8
6Gemini 2.0 Flash77.8
7GPT-4o ChatGPT77.2
8GPT-4.1 (2025-04-14)76.6
9InternVL2.5-78B75.9
10Gemini 1.5 Pro (002)75.3
11Gemini 1.5 Flash (002)74.7
12Claude 3.7 Sonnet74.7
13GPT-4.574.7
14InternVL3-78B74.1
15Qwen 2 VL 72B74.1

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mathvista-tqa · How the rankings work · Data refreshed daily, snapshot 2026-07-22.