OpenVLM MTVQA - Arabic: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 157 models tracked.

Top models

#ModelScore
1GPT-4.1 Mini25.7
2GPT-4.1 (2025-04-14)23.3
3Gemini 1.5 Pro20.6
4Claude 3.7 Sonnet20.5
5Qwen 2 VL 7B16.2
6InternVL3-78B15.9
7Qwen 2 VL 72B15.5
8Gemma 3 27B15.4
9Gemini 1.5 Flash14.7
10GPT-4.1 Nano13.7
11InternVL3-14B13.2
12Gemma 3 12B11.7
13InternVL3-8B9.8
14Grok 2 (1212)8.7
15Gemma 3 4B8.1

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mtvqa-arabic · How It Works · Data refreshed daily, snapshot 2026-09-19.