Open LMM Reasoning - LogicVista - mechanical: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 83 models tracked.

Top models

#ModelScore
1GPT-4o ChatGPT75.7
2Claude 3.7 Sonnet68.9
3GPT-4.1 Mini67.6
4Claude 3.5 Sonnet (20241022)66.2
5InternVL3-38B66.2
6Doubao-1.5-Pro66.2
7Gemini 1.5 Pro (002)64.9
8Grok 2 (1212)64.9
9InternVL2.5-78B62.2
10QVQ-72B-Preview62.2
11GPT-4.1 (2025-04-14)60.8
12InternVL3-8B59.5
13InternVL3-78B56.8
14Gemini 2.0 Flash55.4
15Gemma 3 27B54.1

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-logicvista-mechanical · How It Works · Data refreshed daily, snapshot 2026-09-05.