OpenVLM SEEDBench IMG - Visual Reasoning: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 226 models tracked.

Top models

#ModelScore
1GPT-4.1 (2025-04-14)83.1
2Qwen 2 VL 72B81.9
3InternVL3-8B81.6
4InternVL3-78B81.6
5Llama 3.2 90B Vision Instruct81.3
6GPT-4.1 Mini80.4
7InternVL3-14B80.4
8Grok 2 (1212)80.4
9Gemini 1.0 Pro80.4
10Qwen 2 VL 7B79.8
11Aquila-VL-2B79.5
12Gemini 1.5 Pro79.5
13Moonshot v1 8K79.5
14Qwen 2 VL 2B79.2
15Claude 3.5 Sonnet78.9

Interactive version: theaggregate.ai/benchmark?slug=openvlm-seedbench-img-visual-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-19.