OpenVLM MMBench V1.1 EN - Identity Reasoning: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1GPT-5100
2Qwen 2 VL 72B100
3Gemini 2.5 Pro98.7
4InternVL3-78B98.7
5InternVL3-8B98.7
6Gemini 1.5 Flash (002)98.7
7InternVL2.5-78B98.7
8Gemma 3 27B98.7
9GPT-4.1 (2025-04-14)98.7
10GPT-4o ChatGPT98.7
11GPT-4.1 Mini97.4
12Qwen 2 VL 7B97.4
13Qwen 2 VL 2B97.4
14Gemini 1.5 Pro (002)97.4
15Grok 2 (1212)97.4

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmbench-v1-1-en-identity-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.