Open LMM Reasoning - MathVision - counting: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1GPT-4.1 Mini44.8
2Claude 3.7 Sonnet37.3
3Doubao-1.5-Pro37.3
4Claude 3.5 Sonnet (20241022)35.8
5Gemini 2.0 Flash35.8
6InternVL3-78B34.3
7GPT-4.1 (2025-04-14)32.8
8GPT-4o ChatGPT29.9
9InternVL2.5-78B-CoT29.9
10InternVL3-38B28.4
11InternVL2.5-78B25.4
12Qwen 2 VL 72B23.9
13Aquila-VL-2B22.4
14Gemini 1.5 Pro (002)22.4
15QVQ-72B-Preview22.4

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathvision-counting · How It Works · Data refreshed daily, snapshot 2026-09-05.