OpenVLM MTVQA — leaderboard

OpenCompass OpenVLM evaluation of MTVQA: multilingual text-centric visual question answering over images containing text in Arabic, German, French, Italian, Japanese, Korean, Russian, Thai, Vietnamese, and Chinese.

Metric: Accuracy (%). Source: huggingface.co. Status: saturation imminent. 157 models tracked.

Top models

#ModelScore
1GPT-4.1 Mini36.8
2GPT-4.1 (2025-04-14)34.1
3InternVL3-78B32.5
4InternVL3-38B32.4
5Gemini 1.5 Pro32
6InternVL3-14B31.1
7Claude 3.7 Sonnet30.6
8Gemini 1.5 Flash30.5
9InternVL3-8B30.4
10Ovis2-8B29.7
11Qwen 2 VL 72B29.6
12Gemma 3 27B28.9
13GPT-4.1 Nano27.6
14Qwen 2 VL 7B25.8
15Gemma 3 12B23.8

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mtvqa · How the rankings work · Data refreshed daily, snapshot 2026-07-22.