OpenVLM HallusionBench - fAcc: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1GPT-562.4
2Gemini 2.5 Pro60.1
3GPT-5 Mini (2025-08-07)59.5
4GPT-4.557.5
5GPT-5 Nano56.1
6GPT-4.1 (2025-04-14)54.3
7InternVL3-78B53.5
8Qwen 2 VL 72B53.5
9InternVL3-38B53.2
10GPT-4o ChatGPT52.3
11InternVL2.5-78B51.2
12Gemini 2.0 Flash50.6
13Claude 3.7 Sonnet50
14Claude 3.5 Sonnet (20241022)48.6
15Gemini 1.5 Pro (002)46.8

Interactive version: theaggregate.ai/benchmark?slug=openvlm-hallusionbench-facc · How It Works · Data refreshed daily, snapshot 2026-09-05.