Open LMM Reasoning - MathVista - FQA — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1GPT-4.1 Mini79.2
2InternVL3-78B78.1
3QVQ-72B-Preview77.7
4Qwen 2 VL 72B76.6
5InternVL3-38B75.5
6Doubao-1.5-Pro75.5
7GPT-4o ChatGPT74.3
8InternVL3-14B74
9GPT-4.1 (2025-04-14)73.6
10Claude 3.5 Sonnet (20241022)72.5
11Ovis2-8B70.3
12InternVL2.5-78B70.3
13Gemini 2.0 Flash69.5
14InternVL3-8B69.1
15Qwen 2 VL 7B68.8

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathvista-fqa · How the rankings work · Data refreshed daily, snapshot 2026-07-22.