Open LMM Reasoning - WeMath - Route Map: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 83 models tracked.

Top models

#ModelScore
1Doubao-1.5-Pro78
2Taichu-VLR-7B77.2
3Qwen 2 VL 72B73.9
4Gemini 2.0 Flash70.6
5GPT-4.1 (2025-04-14)70.6
6Claude 3.7 Sonnet70.3
7InternVL3-38B66.2
8InternVL2.5-78B66.2
9InternVL3-78B65.9
10Gemini 1.5 Pro (002)65.7
11Claude 3.5 Sonnet (20241022)62.6
12GPT-4.1 Nano62.6
13GPT-4o ChatGPT62.6
14InternVL3-8B59.1
15Qwen 2 VL 7B55.8

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-wemath-route-map · How It Works · Data refreshed daily, snapshot 2026-09-05.