OpenVLM MMMU - Accounting: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1GPT-5 Nano86.7
2InternVL2.5-78B86.7
3GPT-583.3
4GPT-4.1 (2025-04-14)83.3
5GPT-5 Mini (2025-08-07)83.3
6Gemini 2.5 Pro80
7InternVL3-78B80
8Claude 3.7 Sonnet80
9InternVL3-38B76.7
10Claude 3.5 Sonnet76.7
11Gemini 2.0 Flash76.7
12GPT-4.576.7
13Gemma 3 27B73.3
14GPT-4o ChatGPT73.3
15Claude 3.5 Sonnet (20241022)70

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmmu-accounting · How It Works · Data refreshed daily, snapshot 2026-09-05.