Open LMM Reasoning - DynaMath - Level-high school; Avg — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1Doubao-1.5-Pro73.2
2Gemini 2.0 Flash70.9
3GPT-4o ChatGPT69.7
4GPT-4.1 Mini68.6
5GPT-4.1 (2025-04-14)68.6
6Gemini 1.5 Pro (002)65.7
7Claude 3.7 Sonnet63.9
8Claude 3.5 Sonnet (20241022)63
9QVQ-72B-Preview61.7
10InternVL3-38B60.5
11InternVL3-78B60.1
12InternVL3-14B58.1
13Gemma 3 27B57
14InternVL3-8B54.8
15Grok 2 (1212)53.2

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-dynamath-level-high-school-avg · How the rankings work · Data refreshed daily, snapshot 2026-07-22.