OpenVLM MMBench V1.1 CN - Function Reasoning — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1Ovis2-8B96.7
2GPT-5 (2025-08-07)96.7
3GPT-5 Mini (2025-08-07)96.7
4InternVL3-78B95.6
5InternVL2.5-78B95.6
6Claude 3.7 Sonnet95.6
7Grok 2 (1212)95.6
8InternVL3-38B94.4
9InternVL3-14B94.4
10Claude 3.5 Sonnet94.4
11GPT-4.1 (2025-04-14)94.4
12GPT-4o ChatGPT94.4
13Claude 3.5 Sonnet (20241022)93.3
14Gemini 1.5 Flash (002)93.3
15Pixtral-12B92.2

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmbench-v1-1-cn-function-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.