Open LMM Reasoning - WeMath - Understanding of Plane Figures: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 83 models tracked.

Top models

#ModelScore
1Doubao-1.5-Pro81
2GPT-4.1 (2025-04-14)75.8
3Gemini 1.5 Pro (002)75.3
4Gemini 2.0 Flash73
5InternVL3-38B71.9
6GPT-4o ChatGPT71.9
7Claude 3.5 Sonnet (20241022)70
8InternVL3-78B69.7
9InternVL2.5-78B69
10Claude 3.7 Sonnet67.5
11Taichu-VLR-7B67.2
12Gemma 3 27B66.6
13URSA-8B65.8
14Grok 2 (1212)63.7
15InternVL3-8B63.1

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-wemath-understanding-of-plane-figures · How It Works · Data refreshed daily, snapshot 2026-09-05.