OpenVLM Q-Bench - What (Distortion): leaderboard

Metric: Accuracy (%). Source: huggingface.co. 160 models tracked.

Top models

#ModelScore
1Qwen 2 VL 72B80.7
2Qwen 2 VL 7B79.3
3GPT-4.1 Mini77.3
4Aquila-VL-2B76
5GPT-4.1 (2025-04-14)74.7
6Moonshot v1 8K74
7InternVL3-14B72
8Gemini 1.5 Pro71.3
9InternVL3-8B70.7
10GPT-4.1 Nano70
11InternVL3-78B70
12Gemini 1.5 Flash70
13Gemma 3 12B68.7
14Qwen 2 VL 2B65.3
15Pixtral-12B65.3

Interactive version: theaggregate.ai/benchmark?slug=openvlm-q-bench-what-distortion · How It Works · Data refreshed daily, snapshot 2026-09-19.