OpenVLM A-Bench - Nouns as Adjectives: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 160 models tracked.

Top models

#ModelScore
1Qwen 2 VL 2B86
2GPT-4.1 (2025-04-14)83.7
3InternVL3-78B81.4
4InternVL3-14B81.4
5Aquila-VL-2B81.4
6Gemini 1.5 Pro79.1
7Gemma 3 4B79.1
8Moonshot v1 8K79.1
9InternVL2-8B76.7
10Claude 3.7 Sonnet76.7
11Llama 3.2 11B Instruct76.7
12Gemini 1.5 Flash76.7
13Grok 2 (1212)76.7
14GPT-4.1 Mini74.4
15Qwen 2 VL 7B74.4

Interactive version: theaggregate.ai/benchmark?slug=openvlm-a-bench-nouns-as-adjectives · How It Works · Data refreshed daily, snapshot 2026-09-19.