Medmarks - M-ARC — leaderboard

Metric: Score (%). Source: medmarks.ai. 71 models tracked.

Top models

#ModelScore
1Grok 480
2Qwen 3 Next 80B A3B (Thinking)75
3Gemini 3 Pro (Preview)71.33
4Claude Sonnet 4.571
5Qwen 3 235B A22B (Thinking)66
6GPT-5.1 (Medium)65
7Qwen 3 30B A3B (Thinking)61.33
8GPT-5.2 (Medium)60
9GLM-4.7 FP858.33
10Qwen 3 4B (Reasoning)57.67
11Qwen 3 Next 80B A3B Instruct53
12INTELLECT-352.33
13MiniMax-M246.33
14Qwen 3 14B (Reasoning)45
15Qwen 3 VL 30B A3B (Thinking)44.33

Interactive version: theaggregate.ai/benchmark?slug=medmarks-m-arc · How the rankings work · Data refreshed daily, snapshot 2026-07-22.