Open LMM Reasoning - WeMath - Angles and Length: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 83 models tracked.

Top models

#ModelScore
1Doubao-1.5-Pro66.3
2Gemini 1.5 Pro (002)61.8
3Gemini 2.0 Flash56.3
4Taichu-VLR-7B55.8
5GPT-4.1 (2025-04-14)55.1
6Gemma 3 27B53.7
7Taichu-VLR-3B53.7
8VLAA-Thinker-Qwen2.5VL-3B51
9VLM-R1-3B-Math-030548.4
10VLAA-Thinker-Qwen2.5VL-7B47.7
11Qwen 2 VL 72B45.1
12InternVL3-38B42.5
13GPT-4o ChatGPT42.5
14Aquila-VL-2B41.8
15Gemma 3 4B41

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-wemath-angles-and-length · How It Works · Data refreshed daily, snapshot 2026-09-05.