Open LMM Reasoning - DynaMath - Subject-graph theory; Avg — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1GPT-4o ChatGPT75.4
2GPT-4.1 Mini73.5
3GPT-4.1 (2025-04-14)69
4Claude 3.7 Sonnet62.1
5Gemini 2.0 Flash59.4
6Doubao-1.5-Pro59.4
7Claude 3.5 Sonnet (20241022)58.5
8Gemini 1.5 Pro (002)55.8
9GPT-4.1 Nano51.7
10InternVL3-38B50.6
11InternVL3-78B50.4
12Grok 2 (1212)49.6
13InternVL2.5-78B48.1
14Qwen 2 VL 7B47.5
15Qwen 2 VL 72B46.7

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-dynamath-subject-graph-theory-avg · How the rankings work · Data refreshed daily, snapshot 2026-07-22.