Medmarks - MedConceptsQA Easy — leaderboard

Metric: Score (%). Source: medmarks.ai. 71 models tracked.

Top models

#ModelScore
1Gemini 3 Pro (Preview)100
2GPT-5.1 (Medium)99.97
3Grok 499.95
4Claude Sonnet 4.599.9
5GLM-4.7 FP899.9
6GPT-5.2 (Medium)99.85
7Qwen 3 235B A22B (Thinking)99.47
8MiniMax-M2.198.98
9Qwen 3 Next 80B A3B (Thinking)98.88
10Llama 3.3 70B Instruct98.47
11MiniMax-M298.23
12INTELLECT-397.95
13Qwen 3 Next 80B A3B Instruct97.8
14GPT-OSS-120B (High)97.57
15GPT-OSS-120B (Medium)96.08

Interactive version: theaggregate.ai/benchmark?slug=medmarks-medconceptsqa-easy · How the rankings work · Data refreshed daily, snapshot 2026-07-22.