OpenVLM MMT-Bench - Relation Hallucination: leaderboard

Metric: Score (%). Source: huggingface.co. 207 models tracked.

Top models

#ModelScore
1Pixtral-12B90
2InternVL3-8B85
3Qwen 2 VL 72B85
4Gemini 1.5 Flash85
5InternVL3-78B80
6InternVL3-38B80
7Claude 3.7 Sonnet80
8Grok 2 (1212)80
9GPT-4.1 (2025-04-14)80
10Llama 3.2 90B Vision Instruct80
11Qwen 2 VL 7B75
12Aquila-VL-2B75
13Gemini 1.5 Pro75
14Claude 3.5 Sonnet75
15GPT-4.1 Mini70

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmt-bench-relation-hallucination · How It Works · Data refreshed daily, snapshot 2026-09-05.