OpenVLM MME - Code Reasoning: leaderboard

Metric: Score. Source: huggingface.co. 235 models tracked.

Top models

#ModelScore
1InternVL3-78B192.5
2InternVL3-38B185
3Gemini 2.0 Flash185
4InternVL3-8B177.5
5Qwen 2 VL 72B177.5
6Gemini 1.5 Pro177.5
7InternVL2.5-78B175
8Gemma 3 27B170
9GPT-4.1 (2025-04-14)167.5
10InternVL2-8B160
11Qwen 2 VL 7B160
12Claude 3.5 Sonnet (20241022)160
13Claude 3.7 Sonnet160
14Claude 3.5 Sonnet160
15GPT-4.1 Mini155

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mme-code-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.