OpenVLM HallusionBench - aAcc: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1GPT-577.2
2Gemini 2.5 Pro76
3GPT-5 Mini (2025-08-07)75.1
4GPT-5 Nano74
5GPT-4.573.4
6InternVL3-78B73.2
7GPT-4.1 (2025-04-14)73.1
8Qwen 2 VL 72B72.9
9InternVL2.5-78B72.9
10InternVL3-38B72.3
11Gemini 2.0 Flash72
12Gemini 1.5 Pro (002)71.9
13Claude 3.5 Sonnet (20241022)71.6
14GPT-4o ChatGPT71.4
15Gemini 1.5 Flash (002)69.5

Interactive version: theaggregate.ai/benchmark?slug=openvlm-hallusionbench-aacc · How It Works · Data refreshed daily, snapshot 2026-09-05.