Open LMM Reasoning - DynaMath - Level-undergraduate — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1GPT-4o ChatGPT47.8
2GPT-4.1 Mini41.6
3GPT-4.1 (2025-04-14)41
4Claude 3.7 Sonnet36.6
5Doubao-1.5-Pro36
6Gemini 2.0 Flash34.2
7Claude 3.5 Sonnet (20241022)31.7
8InternVL3-38B29.2
9InternVL3-78B28
10InternVL3-14B26.7
11Gemini 1.5 Pro (002)26.7
12QVQ-72B-Preview26.1
13Gemma 3 27B21.7
14Grok 2 (1212)21.1
15InternVL3-8B20.5

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-dynamath-level-undergraduate · How the rankings work · Data refreshed daily, snapshot 2026-07-22.