Open LMM Reasoning - MathVerse - Applied: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1Doubao-1.5-Pro66.1
2QVQ-72B-Preview53.2
3Gemini 1.5 Pro (002)52.3
4Claude 3.7 Sonnet52.3
5Gemini 2.0 Flash51.4
6VLAA-Thinker-Qwen2.5VL-7B51.4
7InternVL3-78B50.5
8Claude 3.5 Sonnet (20241022)50.5
9GPT-4o ChatGPT50.5
10Taichu-VLR-7B50.5
11InternVL3-38B49.5
12GPT-4.1 (2025-04-14)45.9
13GPT-4.1 Mini44
14InternVL2.5-78B40.4
15InternVL2.5-26B-CoT40.4

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathverse-applied · How It Works · Data refreshed daily, snapshot 2026-09-05.