OpenVLM MMBench V1.1 EN - Physical Property Reasoning: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1GPT-4.1 (2025-04-14)83.5
2GPT-4o ChatGPT81
3GPT-5 Mini (2025-08-07)79.7
4InternVL3-38B77.2
5GPT-4.577.2
6GPT-575.9
7InternVL3-78B75.9
8Qwen 2 VL 72B73.4
9Grok 2 (1212)72.2
10Gemini 2.5 Pro70.9
11Gemini 1.5 Pro (002)70.9
12InternVL2.5-78B69.6
13Gemma 3 27B69.6
14Qwen 2 VL 7B67.1
15Aquila-VL-2B65.8

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmbench-v1-1-en-physical-property-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.