Open LMM Reasoning - MathVista - TQA: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1Doubao-1.5-Pro79.1
2Gemini-2.0-Flash77.8
3GPT-4.1-mini-2025041477.8
4Gemini-2.0-Pro77.2
5ChatGPT-4o-latest77.2
6GPT-4.1-2025041476.6
7InternVL2.5-78B75.9
8Gemini-1.5-Pro-00275.3
9Claude3.7-Sonnet74.7
10InternVL2.5-78B-COT74.7

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathvista-tqa · How It Works · Data refreshed daily, snapshot 2026-09-05.