Open LMM Reasoning - WeMath - Route Map — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 83 models tracked.

Top models

#ModelScore
1Doubao-1.5-Pro78
2Qwen 2 VL 72B73.9
3Gemini 2.0 Flash70.6
4GPT-4.1 (2025-04-14)70.6
5Claude 3.7 Sonnet70.3
6InternVL3-38B66.2
7InternVL2.5-78B66.2
8InternVL3-78B65.9
9Gemini 1.5 Pro (002)65.7
10Claude 3.5 Sonnet (20241022)62.6
11GPT-4.1 Nano62.6
12GPT-4o ChatGPT62.6
13InternVL3-8B59.1
14InternVL3-14B58.5
15Qwen 2 VL 7B55.8

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-wemath-route-map · How the rankings work · Data refreshed daily, snapshot 2026-07-22.