OpenVLM MMMU - Diagnostics and Laboratory Medicine: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1GPT-4.1 (2025-04-14)60
2Claude 3.5 Sonnet (20241022)56.7
3GPT-5 Mini (2025-08-07)56.7
4Gemini 2.5 Pro53.3
5GPT-553.3
6InternVL3-8B53.3
7Qwen 2 VL 72B53.3
8GPT-5 Nano53.3
9Claude 3.5 Sonnet53.3
10GPT-4o ChatGPT53.3
11Claude 3.7 Sonnet50
12InternVL3-78B46.7
13Llama 3.2 90B Vision Instruct46.7
14GPT-4.546.7
15InternVL3-38B43.3

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mmmu-diagnostics-and-laboratory-medicine · How It Works · Data refreshed daily, snapshot 2026-09-05.