OpenVLM LLaVA-Bench - Complex — leaderboard

Metric: Score. Source: huggingface.co. 234 models tracked.

Top models

#ModelScore
1Gemma 3 27B112.4
2GPT-4.1 (2025-04-14)108.9
3Gemma 3 12B108.1
4GPT-4.1 Mini105.6
5Grok 2 (1212)105.3
6InternVL3-78B105.2
7Gemini 1.5 Pro101.9
8Claude 3.7 Sonnet101.3
9Gemini 2.0 Flash100.4
10Gemma 3 4B100
11InternVL3-38B99.5
12GPT-4.1 Nano98.2
13InternVL3-8B97.7
14Ovis2-8B93.8
15InternVL3-14B90.1

Interactive version: theaggregate.ai/benchmark?slug=openvlm-llava-bench-complex · How the rankings work · Data refreshed daily, snapshot 2026-07-22.