OpenVLM Q-Bench - How (Distortion): leaderboard

Metric: Accuracy (%). Source: huggingface.co. 160 models tracked.

Top models

#ModelScore
1GPT-4.1 Mini68.2
2Gemma 3 27B68.2
3InternVL3-78B65.9
4GPT-4.1 (2025-04-14)65.3
5Gemma 3 12B65.3
6Gemini 1.5 Flash64.8
7Qwen 2 VL 7B64.2
8Qwen 2 VL 72B63.6
9GPT-4.1 Nano62.5
10Llama 3.2 11B Instruct62.5
11InternVL3-8B61.9
12InternVL3-14B61.9
13Aquila-VL-2B61.9
14Gemini 1.5 Pro61.4
15Moonshot v1 8K61.4

Interactive version: theaggregate.ai/benchmark?slug=openvlm-q-bench-how-distortion · How It Works · Data refreshed daily, snapshot 2026-09-19.