The Aggregate - Exotic Fact Recall: leaderboard
Metric: Accuracy (%). Source: theaggregate.ai. Saturation forecast: Around April 2028. 12 models tracked.
Top models
| # | Model | Score | Overall rank |
|---|---|---|---|
| 1 | GPT-5.6 Sol (High) | 63.5 | #16 (GPT-5.6 Sol) |
| 2 | Claude Fable 5.1 (High) | 62.4 | #8 (Claude Fable 5.1) |
| 3 | Claude Fable 5 (High) | 61.2 | #13 (Claude Fable 5) |
| 4 | GPT-6 Astra (High) | 56.5 | #5 (GPT-6 Astra) |
| 5 | Gemini 3.7 Flash (High) | 55.3 | #20 (Gemini 3.7 Flash) |
| 6 | Claude Opus 5 (High) | 50.6 | #11 (Claude Opus 5) |
| 7 | DeepSeek V4 Pro (High) | 49.4 | #96 (DeepSeek V4 Pro) |
| 8 | GPT-5.4 (High) | 41.2 | #76 (GPT-5.4) |
| 9 | GPT-5.4 Mini (High) | 36.5 | #202 (GPT-5.4 Mini) |
| 10 | Qwen 3.6 Plus (High) | 31.8 | #113 (Qwen 3.6 Plus) |
| 11 | Claude Haiku 4.5 (High) | 23.5 | #271 (Claude Haiku 4.5) |
No result here: #3 Claude Opus 5.5, #9 GPT-6.1 Sol, #10 Claude Sonnet 5.5.
Interactive version: theaggregate.ai/benchmark?slug=the-aggregate-exotic-fact-recall · How It Works · Data refreshed daily, snapshot 2026-10-11.