OpenVLM MMT-Bench - Counting By Visual Prompting: leaderboard

Metric: Score (%). Source: huggingface.co. 207 models tracked.

Top models

#ModelScore
1GPT-4.1 Mini65
2Qwen 2 VL 2B55
3Claude 3.5 Sonnet55
4Grok 2 (1212)50
5Qwen 2 VL 72B45
6Claude 3.7 Sonnet45
7GPT-4.1 (2025-04-14)45
8GPT-4.1 Nano40
9Gemma 3 4B40
10Gemma 3 27B35
11Gemma 3 12B35
12Claude 3 Sonnet35
13InternVL3-78B30
14InternVL3-8B30
15InternVL3-38B30

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmt-bench-counting-by-visual-prompting · How It Works · Data refreshed daily, snapshot 2026-09-05.