Open LMM Reasoning - MathVista - LOG — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1GPT-4.1 (2025-04-14)54.1
2GPT-4.1 Mini51.4
3Claude 3.5 Sonnet (20241022)45.9
4GPT-4o ChatGPT43.2
5InternVL3-38B37.8
6Doubao-1.5-Pro37.8
7InternVL3-78B35.1
8Grok 2 (1212)35.1
9QVQ-72B-Preview35.1
10InternVL3-8B32.4
11Qwen 2 VL 72B32.4
12Gemini 1.5 Pro (002)32.4
13Gemini 2.0 Flash32.4
14GPT-4.1 Nano29.7
15Claude 3.7 Sonnet29.7

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathvista-log · How the rankings work · Data refreshed daily, snapshot 2026-07-22.