OpenVLM MMBench V1.1 EN - Function Reasoning: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1InternVL2.5-78B98.9
2Llama 3.2 90B Vision Instruct97.8
3Gemini 1.5 Flash (002)96.7
4Grok 2 (1212)96.7
5Gemini 1.5 Flash96.7
6InternVL3-78B95.6
7Gemma 3 12B95.6
8GPT-5 Mini (2025-08-07)95.6
9Qwen 2 VL 72B94.4
10InternVL3-38B94.4
11Aquila-VL-2B94.4
12Gemini 1.5 Pro (002)94.4
13Pixtral-12B94.4
14GPT-4.1 (2025-04-14)94.4
15GPT-4o ChatGPT94.4

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmbench-v1-1-en-function-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.