OpenVLM HallusionBench - qAcc: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro56.3
2GPT-556
3GPT-5 Mini (2025-08-07)53
4GPT-5 Nano52.7
5Gemini 2.0 Flash51.4
6InternVL3-78B50.8
7Qwen 2 VL 72B49.7
8InternVL3-38B49.7
9GPT-4.549.2
10Gemini 1.5 Pro (002)49
11InternVL2.5-78B48.1
12GPT-4.1 (2025-04-14)48.1
13GPT-4o ChatGPT47.3
14Gemini 1.5 Flash (002)47
15Claude 3.7 Sonnet46.8

Interactive version: theaggregate.ai/benchmark?slug=openvlm-hallusionbench-qacc · How It Works · Data refreshed daily, snapshot 2026-09-05.