Open LMM Reasoning - MathVerse - Area: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1Doubao-1.5-Pro51.6
2GPT-4o ChatGPT46.2
3Gemini 1.5 Pro (002)44
4GPT-4.1 Mini41.8
5InternVL3-38B41.8
6GPT-4.1 (2025-04-14)41.8
7InternVL3-78B40.7
8QVQ-72B-Preview38.5
9Claude 3.7 Sonnet37.4
10Claude 3.5 Sonnet (20241022)36.3
11InternVL3-8B33
12Gemini 2.0 Flash31.9
13VLAA-Thinker-Qwen2.5VL-7B31.9
14Taichu-VLR-7B31.9
15InternVL2.5-8B-BoN-830.8

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathverse-area · How It Works · Data refreshed daily, snapshot 2026-09-05.