Open LMM Reasoning - DynaMath - Level-high school; Avg: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1Doubao-1.5-Pro73.2
2Gemini 2.0 Flash70.9
3GPT-4o ChatGPT69.7
4GPT-4.1 Mini68.6
5GPT-4.1 (2025-04-14)68.6
6Gemini 1.5 Pro (002)65.7
7Claude 3.7 Sonnet63.9
8Claude 3.5 Sonnet (20241022)63
9QVQ-72B-Preview61.7
10InternVL3-38B60.5
11InternVL3-78B60.1
12InternVL2.5-78B-CoT57.4
13Gemma 3 27B57
14VLAA-Thinker-Qwen2.5VL-7B55.6
15Taichu-VLR-7B55.5

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-dynamath-level-high-school-avg · How It Works · Data refreshed daily, snapshot 2026-09-05.