Open LMM Reasoning - WeMath - Position — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 83 models tracked.

Top models

#ModelScore
1InternVL2.5-78B81.4
2Doubao-1.5-Pro81.4
3Gemini 1.5 Pro (002)78.1
4Qwen 2 VL 72B76.1
5InternVL3-78B74.7
6InternVL3-38B73.6
7GPT-4o ChatGPT73
8InternVL3-14B71.7
9Gemini 2.0 Flash71.7
10Claude 3.7 Sonnet69.1
11GPT-4.1 Nano68.8
12GPT-4.1 (2025-04-14)68.2
13Gemma 3 27B68.1
14Claude 3.5 Sonnet (20241022)66.6
15Grok 2 (1212)65.8

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-wemath-position · How the rankings work · Data refreshed daily, snapshot 2026-07-22.