Open LMM Reasoning - DynaMath - Overall; Avg — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1GPT-4o ChatGPT72.7
2Doubao-1.5-Pro71.8
3GPT-4.1 Mini71.6
4GPT-4.1 (2025-04-14)70.8
5Gemini 2.0 Flash69.5
6Claude 3.7 Sonnet65.6
7Gemini 1.5 Pro (002)65.3
8Claude 3.5 Sonnet (20241022)63.9
9InternVL3-78B61.3
10InternVL3-38B61.3
11QVQ-72B-Preview60.8
12InternVL3-14B58.5
13Gemma 3 27B56.1
14GPT-4.1 Nano54.7
15InternVL3-8B54.6

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-dynamath-overall-avg · How the rankings work · Data refreshed daily, snapshot 2026-07-22.