OpenVLM MMT-Bench - Counting By Reasoning — leaderboard

Metric: Score (%). Source: huggingface.co. 207 models tracked.

Top models

#ModelScore
1Claude 3.5 Sonnet95
2Qwen 2 VL 72B90
3Pixtral-12B90
4Claude 3.7 Sonnet90
5Grok 2 (1212)90
6GPT-4.1 (2025-04-14)90
7Llama 3.2 90B Vision Instruct90
8Ovis2-8B85
9MiniCPM-V-2.685
10Claude 3 Sonnet85
11InternVL3-8B80
12InternVL3-38B80
13Llama 3.2 11B Instruct80
14Gemini 1.5 Pro80
15Gemini 1.5 Flash80

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmt-bench-counting-by-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.