OpenVLM MMT-Bench - Counting By Reasoning: leaderboard

Metric: Score (%). Source: huggingface.co. 207 models tracked.

Top models

#ModelScore
1Claude 3.5 Sonnet95
2Qwen 2 VL 72B90
3Pixtral-12B90
4Claude 3.7 Sonnet90
5Grok 2 (1212)90
6GPT-4.1 (2025-04-14)90
7Llama 3.2 90B Vision Instruct90
8Claude 3 Sonnet85
9InternVL3-8B80
10InternVL3-38B80
11Llama 3.2 11B Instruct80
12Gemini 1.5 Pro80
13Gemini 1.5 Flash80
14GPT-4.1 Mini75
15InternVL3-78B75

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmt-bench-counting-by-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.