Benchmarks.bio - scBench-Long — leaderboard

Metric: Pass Rate (%). Source: benchmarks.bio. 17 models tracked.

Top models

#ModelScore
1GPT-5.6 Sol38.1
2Claude Opus 4.825.4
3GPT-5.6 Terra23.81
4Gemini 3.5 Flash22.22
5GPT-5.6 Luna19.05
6Gemini 3.1 Pro (Preview)17.46
7GPT-5.515.87
8Claude Sonnet 514.29
9Grok 4.512.7
10Claude Opus 4.711.11
11GPT-5.49.52
12Claude Opus 4.69.52
13GLM-5.29.52
14Claude Sonnet 4.67.94
15Grok 4.20 Beta (0309) (Reasoning)6.35

Interactive version: theaggregate.ai/benchmark?slug=benchmarks-bio-scbench-long · How the rankings work · Data refreshed daily, snapshot 2026-07-22.