OpenVLM HallusionBench - qAcc — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro56.3
2GPT-5 (2025-08-07)56
3GPT-5 Mini (2025-08-07)53
4GPT-5 Nano52.7
5Gemini 2.0 Flash51.4
6InternVL3-78B50.8
7Qwen 2 VL 72B49.7
8InternVL3-38B49.7
9GPT-4.549.2
10Gemini 1.5 Pro (002)49
11InternVL2.5-78B48.1
12GPT-4.1 (2025-04-14)48.1
13InternVL3-14B47.7
14Ovis2-8B47.5
15GPT-4o ChatGPT47.3

Interactive version: theaggregate.ai/benchmark?slug=openvlm-hallusionbench-qacc · How the rankings work · Data refreshed daily, snapshot 2026-07-22.