Open LMM Reasoning - LogicVista - mechanical — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 83 models tracked.

Top models

#ModelScore
1GPT-4o ChatGPT75.7
2Claude 3.7 Sonnet68.9
3GPT-4.1 Mini67.6
4InternVL3-38B66.2
5Claude 3.5 Sonnet (20241022)66.2
6Doubao-1.5-Pro66.2
7Gemini 1.5 Pro (002)64.9
8Grok 2 (1212)64.9
9InternVL2.5-78B62.2
10QVQ-72B-Preview62.2
11GPT-4.1 (2025-04-14)60.8
12InternVL3-8B59.5
13InternVL3-78B56.8
14Gemini 2.0 Flash55.4
15InternVL3-14B54.1

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-logicvista-mechanical · How the rankings work · Data refreshed daily, snapshot 2026-07-22.