Open LMM Reasoning - DynaMath - Level-elementary school; Avg: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1GPT-4.1 Mini78.1
2GPT-4o ChatGPT76.5
3GPT-4.1 (2025-04-14)74.9
4Doubao-1.5-Pro72.9
5Claude 3.7 Sonnet67.8
6InternVL3-38B67
7Gemini 2.0 Flash67
8InternVL3-78B66.7
9Claude 3.5 Sonnet (20241022)65.1
10Gemini 1.5 Pro (002)64.8
11InternVL2.5-78B-CoT63
12QVQ-72B-Preview61.4
13Taichu-VLR-7B61.4
14GPT-4.1 Nano60.2
15VLAA-Thinker-Qwen2.5VL-7B59.4

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-dynamath-level-elementary-school-avg · How It Works · Data refreshed daily, snapshot 2026-09-05.