OpenVLM Q-Bench - How (Others): leaderboard

Metric: Accuracy (%). Source: huggingface.co. 160 models tracked.

Top models

#ModelScore
1Gemini 1.5 Pro77.9
2InternVL3-78B77.2
3GPT-4.1 (2025-04-14)75.9
4GPT-4.1 Nano75.2
5GPT-4.1 Mini73.1
6InternVL3-8B72.4
7Moonshot v1 8K72.4
8Qwen 2 VL 72B71.7
9Llama 3.2 11B Instruct71.7
10InternVL3-14B71
11Gemma 3 12B71
12Pixtral-12B70.3
13InternVL2-8B69
14Gemini 1.5 Flash69
15Grok 2 (1212)69

Interactive version: theaggregate.ai/benchmark?slug=openvlm-q-bench-how-others · How It Works · Data refreshed daily, snapshot 2026-09-19.