OpenVLM Q-Bench - What (Others): leaderboard

Metric: Accuracy (%). Source: huggingface.co. 160 models tracked.

Top models

#ModelScore
1Qwen 2 VL 72B87.5
2Moonshot v1 8K87.5
3InternVL3-78B86.6
4InternVL3-14B84.8
5Qwen 2 VL 2B84.8
6GPT-4.1 Mini83.9
7InternVL3-8B83.9
8Gemma 3 12B83.9
9Gemma 3 27B83
10Qwen 2 VL 7B82.1
11Grok 2 (1212)82.1
12GPT-4.1 (2025-04-14)81.2
13GPT-4.1 Nano80.4
14Aquila-VL-2B79.5
15Llama 3.2 11B Instruct78.6

Interactive version: theaggregate.ai/benchmark?slug=openvlm-q-bench-what-others · How It Works · Data refreshed daily, snapshot 2026-09-19.