CLBench Life - Fragmented Information & Revisions: leaderboard

Metric: Solving Rate (%). Source: www.clbench.com. 29 models tracked.

Top models

#ModelScore
1GPT-5.5 (High)17.8
2GPT-5.4 (xHigh)17.4
3Claude Opus 4.6 (High)16.5
4Hy3-preview (High)15.9
5GPT-5.4 (High)15.8
6Gemini 3.1 Pro (Preview) (High)13.6
7Gemini 3.1 Pro (Preview)13.3
8DeepSeek V4 Pro (High)12.1
9Seed 2.0 Pro (High)12.1
10Kimi K2.511.9
11GPT-5.1 (High)11.9
12Kimi K2.5 (High)11.4
13Claude Opus 4.611.1
14GPT-5.410.4
15Seed 2.0 Pro10.4

Interactive version: theaggregate.ai/benchmark?slug=clbench-life-fragmented-information-revisions · How It Works · Data refreshed daily, snapshot 2026-09-19.