OpenVLM MMStar - Logical Reasoning: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1GPT-580.8
2GPT-4o ChatGPT80.8
3GPT-5 Mini (2025-08-07)80.8
4InternVL3-38B79.2
5InternVL2.5-78B78.4
6GPT-4.1 (2025-04-14)78.4
7Gemini 2.5 Pro76.8
8InternVL3-78B76.8
9GPT-4.576.8
10Gemini 2.0 Flash75.6
11Claude 3.5 Sonnet (20241022)74.4
12GPT-5 Nano73.6
13Qwen 2 VL 72B72.4
14Grok 2 (1212)71.6
15Claude 3.7 Sonnet70.8

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmstar-logical-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.