MedLayXPlain — leaderboard

Metric: S (self-reported). Source: benchmarklist.com. 32 models tracked.

Top models

#ModelScore
1Qwen 3 VL 32B (Thinking)65.4
2Qwen 3 VL 30B A3B (Thinking)64.8
3InternVL3-8B64.7
4Qwen 3 VL 8B (Thinking)64.6
5Claude Opus 4.764.1
6Qwen 3 VL 4B (Thinking)63.3
7Qwen 3.6 35B A3B61.5
8GPT-5.4 Mini61.2
9GPT-5.560.6
10Gemini 3 Flash (Preview)59.1
11InternVL3.5-8B58.7
12Qwen 3.5 0.8B (Thinking)58.2
13Qwen 3.5 9B54.5
14Llama 4 Scout51.1
15Claude Haiku 4.550

Interactive version: theaggregate.ai/benchmark?slug=medlayxplain · How the rankings work · Data refreshed daily, snapshot 2026-07-22.