Open LMM Reasoning - LogicVista — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 83 models tracked.

Top models

#ModelScore
1GPT-4.1 Mini64.9
2GPT-4o ChatGPT64.4
3Doubao-1.5-Pro64.2
4GPT-4.1 (2025-04-14)61.1
5Claude 3.5 Sonnet (20241022)60.4
6Claude 3.7 Sonnet58.2
7QVQ-72B-Preview58.2
8InternVL3-38B57.7
9InternVL3-78B55.9
10Gemini 1.5 Pro (002)54.4
11Gemini 2.0 Flash52.3
12InternVL3-14B52.1
13Grok 2 (1212)49.9
14InternVL2.5-78B49
15Gemma 3 27B47.9

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-logicvista · How the rankings work · Data refreshed daily, snapshot 2026-07-22.