OpenVLM MMBench V1.1 CN - Function Reasoning: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1GPT-596.7
2GPT-5 Mini (2025-08-07)96.7
3InternVL3-78B95.6
4InternVL2.5-78B95.6
5Claude 3.7 Sonnet95.6
6Grok 2 (1212)95.6
7InternVL3-38B94.4
8Claude 3.5 Sonnet94.4
9GPT-4.1 (2025-04-14)94.4
10GPT-4o ChatGPT94.4
11Claude 3.5 Sonnet (20241022)93.3
12Gemini 1.5 Flash (002)93.3
13Pixtral-12B92.2
14Claude 3 Sonnet92.2
15GPT-4.592.2

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmbench-v1-1-cn-function-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.