OpenVLM MathVista - TQA: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1GPT-584.8
2Gemini 2.5 Pro83.5
3GPT-5 Nano80.4
4GPT-5 Mini (2025-08-07)80.4
5Doubao-1.5-Pro79.1
6GPT-4.1 Mini77.8
7Gemini 2.0 Flash77.8
8GPT-4o ChatGPT77.2
9GPT-4.1 (2025-04-14)76.6
10InternVL2.5-78B75.9
11Gemini 1.5 Pro (002)75.3
12Gemini 1.5 Flash (002)74.7
13Claude 3.7 Sonnet74.7
14GPT-4.574.7
15InternVL2.5-78B-CoT74.7

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mathvista-tqa · How It Works · Data refreshed daily, snapshot 2026-09-05.