Agents' Last Exam (ALE-Claw): leaderboard
Metric: Overall Pass Rate (%). Source: snorkel.ai. Saturation forecast: Rough model projection: around 2026. 3 models tracked.
Top models
| # | Model | Score |
|---|---|---|
| 1 | GPT-5.5 (ALE Run: harness=ALE-Claw; effort=High; source-model=GPT-5.5) | 23.03 |
| 2 | Claude Opus 4.7 (ALE Run: harness=ALE-Claw; effort=High; source-model=Claude%20Opus%204.7) | 18.42 |
| 3 | GPT-5.4 (ALE Run: harness=ALE-Claw; effort=High; source-model=GPT-5.4) | 11.84 |
Interactive version: theaggregate.ai/benchmark?slug=agents-last-exam-ale-claw · How It Works · Data refreshed daily, snapshot 2026-10-09.