Medmarks - SCTpublic — leaderboard

Metric: Score (%). Source: medmarks.ai. 71 models tracked.

Top models

#ModelScore
1GPT-5.1 (Medium)77.96
2GPT-5.2 (Medium)74.26
3Grok 473.57
4Claude Sonnet 4.572.29
5GPT-OSS-120B (Medium)71.35
6GPT-OSS-120B (Low)70.41
7MiniMax-M2.170.01
8MiniMax-M269.55
9Gemini 3 Pro (Preview)68.82
10GPT-OSS-20B (High)68.35
11Qwen 3 Next 80B A3B (Thinking)68.23
12GLM-4.7 FP868.11
13Qwen 3 8B (Thinking)67.82
14OLMo 3 32B (Thinking)67.64
15GPT-OSS-120B (High)67.57

Interactive version: theaggregate.ai/benchmark?slug=medmarks-sctpublic · How the rankings work · Data refreshed daily, snapshot 2026-07-22.