Open LMM Reasoning - MathVerse - Expression: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1Doubao-1.5-Pro56.2
2GPT-4.1 Mini40.6
3InternVL3-78B34.4
4InternVL2.5-78B-CoT34.4
5Claude 3.7 Sonnet31.2
6Gemini 2.0 Flash31.2
7GPT-4o ChatGPT31.2
8InternVL3-38B28.1
9InternVL3-8B25
10Gemini 1.5 Pro (002)25
11InternVL2.5-78B25
12QVQ-72B-Preview25
13Qwen 2 VL 72B21.9
14Claude 3.5 Sonnet (20241022)21.9
15GPT-4.1 (2025-04-14)21.9

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathverse-expression · How It Works · Data refreshed daily, snapshot 2026-09-05.