Open LMM Reasoning - MathVerse - Expression — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1Doubao-1.5-Pro56.2
2GPT-4.1 Mini40.6
3InternVL3-78B34.4
4Claude 3.7 Sonnet31.2
5Gemini 2.0 Flash31.2
6GPT-4o ChatGPT31.2
7InternVL3-38B28.1
8InternVL3-8B25
9Gemini 1.5 Pro (002)25
10InternVL2.5-78B25
11QVQ-72B-Preview25
12Qwen 2 VL 72B21.9
13InternVL3-14B21.9
14Claude 3.5 Sonnet (20241022)21.9
15GPT-4.1 (2025-04-14)21.9

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathverse-expression · How the rankings work · Data refreshed daily, snapshot 2026-07-22.