OpenVLM MMMU - Diagnostics and Laboratory Medicine — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1GPT-4.1 (2025-04-14)60
2Claude 3.5 Sonnet (20241022)56.7
3GPT-5 Mini (2025-08-07)56.7
4Gemini 2.5 Pro53.3
5InternVL3-8B53.3
6Qwen 2 VL 72B53.3
7GPT-5 Nano53.3
8Claude 3.5 Sonnet53.3
9GPT-4o ChatGPT53.3
10GPT-5 (2025-08-07)53.3
11InternVL3-14B50
12Claude 3.7 Sonnet50
13InternVL3-78B46.7
14Llama 3.2 90B Vision Instruct46.7
15GPT-4.546.7

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmmu-diagnostics-and-laboratory-medicine · How the rankings work · Data refreshed daily, snapshot 2026-07-22.