OpenVLM Q-Bench: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 160 models tracked.

Top models

#ModelScore
1Qwen 2 VL 72B80.3
2GPT-4.1 Mini80
3GPT-4.1 (2025-04-14)79.7
4InternVL3-78B78.8
5Moonshot v1 8K77.5
6Qwen 2 VL 7B76.9
7InternVL3-14B76.7
8InternVL3-8B75.9
9GPT-4.1 Nano74.8
10Gemini 1.5 Pro74.7
11Aquila-VL-2B74.2
12Qwen 2 VL 2B73.9
13Gemini 1.5 Flash73.7
14Pixtral-12B73.4
15Gemma 3 12B73.3

Interactive version: theaggregate.ai/benchmark?slug=openvlm-q-bench · How It Works · Data refreshed daily, snapshot 2026-09-19.