Open LMM Reasoning - DynaMath - Level-undergraduate; Avg — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1GPT-4o ChatGPT76.2
2GPT-4.1 Mini74.3
3GPT-4.1 (2025-04-14)73
4Doubao-1.5-Pro69
5Gemini 2.0 Flash68
6Claude 3.7 Sonnet67.6
7Claude 3.5 Sonnet (20241022)65
8Gemini 1.5 Pro (002)64.7
9InternVL3-78B61.2
10InternVL3-38B60.6
11QVQ-72B-Preview58.9
12InternVL3-14B57.4
13GPT-4.1 Nano56.3
14Grok 2 (1212)54.7
15Gemma 3 27B54

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-dynamath-level-undergraduate-avg · How the rankings work · Data refreshed daily, snapshot 2026-07-22.