Medmarks - Medbullets OP5 — leaderboard

Metric: Score (%). Source: medmarks.ai. 71 models tracked.

Top models

#ModelScore
1Gemini 3 Pro (Preview)87.66
2GPT-5.2 (Medium)87.23
3GPT-5.1 (Medium)87.23
4GLM-4.7 FP884.52
5Grok 483.98
6GPT-OSS-120B (High)82.58
7Qwen 3 235B A22B (Thinking)81.82
8GPT-OSS-120B (Medium)80.95
9Claude Sonnet 4.580.52
10Qwen 3 Next 80B A3B (Thinking)78.79
11MiniMax-M2.177.27
12Qwen 3 Next 80B A3B Instruct76.95
13INTELLECT-376.84
14MiniMax-M276.41
15GPT-OSS-120B (Low)76.08

Interactive version: theaggregate.ai/benchmark?slug=medmarks-medbullets-op5 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.