OpenVLM HallusionBench - aAcc — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1GPT-5 (2025-08-07)77.2
2Gemini 2.5 Pro76
3GPT-5 Mini (2025-08-07)75.1
4GPT-5 Nano74
5GPT-4.573.4
6InternVL3-78B73.2
7GPT-4.1 (2025-04-14)73.1
8Qwen 2 VL 72B72.9
9InternVL2.5-78B72.9
10InternVL3-38B72.3
11Gemini 2.0 Flash72
12Gemini 1.5 Pro (002)71.9
13Claude 3.5 Sonnet (20241022)71.6
14GPT-4o ChatGPT71.4
15InternVL3-14B70.6

Interactive version: theaggregate.ai/benchmark?slug=openvlm-hallusionbench-aacc · How the rankings work · Data refreshed daily, snapshot 2026-07-22.