OpenVLM MMT-Bench - Visual Prompt Understanding: leaderboard

Metric: Score (%). Source: huggingface.co. 207 models tracked.

Top models

#ModelScore
1InternVL3-78B90
2GPT-4.1 Mini85
3Qwen 2 VL 72B85
4InternVL3-38B85
5Qwen 2 VL 7B80
6Gemma 3 27B80
7Gemini 1.5 Flash80
8GPT-4.1 (2025-04-14)80
9InternVL3-8B75
10Gemini 1.5 Pro75
11Claude 3.5 Sonnet75
12Claude 3.7 Sonnet70
13Llama 3.2 90B Vision Instruct70
14Pixtral-12B65
15Llama 3.2 11B Instruct65

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmt-bench-visual-prompt-understanding · How It Works · Data refreshed daily, snapshot 2026-09-05.