OpenVLM MMBench V1.1 EN - Identity Reasoning — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1Qwen 2 VL 72B100
2GPT-5 (2025-08-07)100
3Gemini 2.5 Pro98.7
4InternVL3-78B98.7
5InternVL3-8B98.7
6Ovis2-8B98.7
7Gemini 1.5 Flash (002)98.7
8InternVL2.5-78B98.7
9Gemma 3 27B98.7
10GPT-4.1 (2025-04-14)98.7
11GPT-4o ChatGPT98.7
12GPT-4.1 Mini97.4
13Qwen 2 VL 7B97.4
14Qwen 2 VL 2B97.4
15InternVL3-14B97.4

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmbench-v1-1-en-identity-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.