OpenVLM MMT-Bench - Set-of-Mark Recognition: leaderboard

Metric: Score (%). Source: huggingface.co. 207 models tracked.

Top models

#ModelScore
1GPT-4.1 Mini100
2InternVL3-38B100
3GPT-4.1 (2025-04-14)100
4InternVL3-78B94.7
5InternVL3-8B94.7
6Qwen 2 VL 72B94.7
7Llama 3.2 11B Instruct94.7
8Claude 3.5 Sonnet94.7
9Llama 3.2 90B Vision Instruct94.7
10Qwen 2 VL 7B89.5
11Claude 3.7 Sonnet89.5
12Gemini 1.5 Pro89.5
13Gemini 1.5 Flash89.5
14Pixtral-12B84.2
15Claude 3 Haiku84.2

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmt-bench-set-of-mark-recognition · How It Works · Data refreshed daily, snapshot 2026-09-05.