Open LMM Reasoning - MathVerse - Area — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1Doubao-1.5-Pro51.6
2GPT-4o ChatGPT46.2
3Gemini 1.5 Pro (002)44
4GPT-4.1 Mini41.8
5InternVL3-38B41.8
6GPT-4.1 (2025-04-14)41.8
7InternVL3-78B40.7
8InternVL3-14B38.5
9QVQ-72B-Preview38.5
10Claude 3.7 Sonnet37.4
11Claude 3.5 Sonnet (20241022)36.3
12Ovis2-8B34.1
13InternVL3-8B33
14Gemini 2.0 Flash31.9
15Gemma 3 27B27.5

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathverse-area · How the rankings work · Data refreshed daily, snapshot 2026-07-22.