Open LMM Reasoning - DynaMath - Level-undergraduate; Avg: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1GPT-4o ChatGPT76.2
2GPT-4.1 Mini74.3
3GPT-4.1 (2025-04-14)73
4Doubao-1.5-Pro69
5Gemini 2.0 Flash68
6Claude 3.7 Sonnet67.6
7Claude 3.5 Sonnet (20241022)65
8Gemini 1.5 Pro (002)64.7
9InternVL3-78B61.2
10InternVL3-38B60.6
11QVQ-72B-Preview58.9
12Taichu-VLR-7B56.8
13GPT-4.1 Nano56.3
14VLAA-Thinker-Qwen2.5VL-7B55.3
15Grok 2 (1212)54.7

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-dynamath-level-undergraduate-avg · How It Works · Data refreshed daily, snapshot 2026-09-05.