Open LMM Reasoning - MathVerse - Functions — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1Doubao-1.5-Pro64.8
2GPT-4.1 Mini59.1
3Gemini 1.5 Pro (002)58.5
4GPT-4.1 (2025-04-14)58.5
5Gemini 2.0 Flash57.9
6GPT-4o ChatGPT57.9
7InternVL3-78B56.6
8InternVL3-38B54.1
9Claude 3.7 Sonnet52.8
10QVQ-72B-Preview52.2
11Claude 3.5 Sonnet (20241022)50.9
12Qwen 2 VL 72B49.1
13InternVL2.5-78B49.1
14InternVL3-14B46.5
15InternVL3-8B42.1

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathverse-functions · How the rankings work · Data refreshed daily, snapshot 2026-07-22.