Open LMM Reasoning - MathVision - counting — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1GPT-4.1 Mini44.8
2Claude 3.7 Sonnet37.3
3Doubao-1.5-Pro37.3
4Claude 3.5 Sonnet (20241022)35.8
5Gemini 2.0 Flash35.8
6InternVL3-78B34.3
7GPT-4.1 (2025-04-14)32.8
8GPT-4o ChatGPT29.9
9InternVL3-38B28.4
10InternVL3-14B26.9
11InternVL2.5-78B25.4
12Qwen 2 VL 72B23.9
13Ovis2-8B22.4
14Aquila-VL-2B22.4
15Gemini 1.5 Pro (002)22.4

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathvision-counting · How the rankings work · Data refreshed daily, snapshot 2026-07-22.