OpenVLM MMStar - Logical Reasoning — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1GPT-4o ChatGPT80.8
2GPT-5 (2025-08-07)80.8
3GPT-5 Mini (2025-08-07)80.8
4InternVL3-38B79.2
5InternVL2.5-78B78.4
6GPT-4.1 (2025-04-14)78.4
7Gemini 2.5 Pro76.8
8InternVL3-78B76.8
9GPT-4.576.8
10Gemini 2.0 Flash75.6
11Claude 3.5 Sonnet (20241022)74.4
12GPT-5 Nano73.6
13Qwen 2 VL 72B72.4
14Grok 2 (1212)71.6
15InternVL3-14B71.2

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmstar-logical-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.