Medmarks - SCTpublic: leaderboard

Metric: Score (%). Source: medmarks.ai. 71 models tracked.

Top models

#ModelScore
1GPT-5.1 (Medium)77.96
2GPT-5.2 (Medium)74.26
3Grok 473.57
4Claude Sonnet 4.572.29
5GPT-OSS-120B (Medium)71.35
6GPT-OSS-120B (Low)70.41
7MiniMax-M2.170.01
8MiniMax-M269.55
9Gemini 3 Pro (Preview)68.82
10GPT-OSS-20B (High)68.35
11Qwen 3 Next 80B A3B (Thinking)68.23
12GLM-4.7 FP868.11
13OLMo 3 32B (Thinking)67.64
14GPT-OSS-120B (High)67.57
15Qwen 3 Next 80B A3B Instruct65.9

Interactive version: theaggregate.ai/benchmark?slug=medmarks-sctpublic · How It Works · Data refreshed daily, snapshot 2026-09-05.