Open LMM Reasoning - DynaMath — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1GPT-4o ChatGPT48.5
2GPT-4.1 Mini47.7
3Doubao-1.5-Pro44.9
4GPT-4.1 (2025-04-14)43.3
5Gemini 2.0 Flash42.1
6Claude 3.7 Sonnet39.7
7Claude 3.5 Sonnet (20241022)35.7
8InternVL3-78B35.1
9InternVL3-38B34.7
10Gemini 1.5 Pro (002)31.5
11QVQ-72B-Preview30.7
12InternVL3-14B30.3
13Gemma 3 27B27.5
14InternVL3-8B25.7
15Grok 2 (1212)25

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-dynamath · How the rankings work · Data refreshed daily, snapshot 2026-07-22.