OpenVLM MMBench V1.1 EN - Function Reasoning — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1InternVL2.5-78B98.9
2Llama 3.2 90B Vision Instruct97.8
3Gemini 1.5 Flash (002)96.7
4Grok 2 (1212)96.7
5Gemini 1.5 Flash96.7
6InternVL3-78B95.6
7Gemma 3 12B95.6
8GPT-5 Mini (2025-08-07)95.6
9Qwen 2 VL 72B94.4
10InternVL3-38B94.4
11Ovis2-8B94.4
12Aquila-VL-2B94.4
13MiniCPM-V-2.694.4
14Gemini 1.5 Pro (002)94.4
15Pixtral-12B94.4

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmbench-v1-1-en-function-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.