Open LMM Reasoning - DynaMath - Level-elementary school; Avg — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1GPT-4.1 Mini78.1
2GPT-4o ChatGPT76.5
3GPT-4.1 (2025-04-14)74.9
4Doubao-1.5-Pro72.9
5Claude 3.7 Sonnet67.8
6InternVL3-38B67
7Gemini 2.0 Flash67
8InternVL3-78B66.7
9Claude 3.5 Sonnet (20241022)65.1
10Gemini 1.5 Pro (002)64.8
11InternVL3-14B62.9
12QVQ-72B-Preview61.4
13GPT-4.1 Nano60.2
14Grok 2 (1212)59
15InternVL3-8B57.9

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-dynamath-level-elementary-school-avg · How the rankings work · Data refreshed daily, snapshot 2026-07-22.