OpenVLM ChartQA Test - Human: leaderboard

Metric: Relaxed Accuracy (%). Source: huggingface.co. 108 models tracked.

Top models

#ModelScore
1Qwen 2 VL 72B81.8
2InternVL3-14B80.5
3InternVL3-8B77
4Pixtral-12B62.2
5GPT-4.1 Mini38.4
6GPT-4.1 (2025-04-14)37.3
7GPT-4.1 Nano34.2
8Gemini 1.5 Flash32.8
9Gemma 3 12B31.9
10Aquila-VL-2B27.2
11Gemma 3 27B26.6
12Gemma 3 4B24.5

Interactive version: theaggregate.ai/benchmark?slug=openvlm-chartqa-test-human · How It Works · Data refreshed daily, snapshot 2026-09-19.