The Aggregate - Exotic Fact Recall: leaderboard

Metric: Accuracy (%). Source: theaggregate.ai. Saturation forecast: Around April 2028. 12 models tracked.

Top models

#ModelScoreOverall rank
1GPT-5.6 Sol (High)63.5#16 (GPT-5.6 Sol)
2Claude Fable 5.1 (High)62.4#8 (Claude Fable 5.1)
3Claude Fable 5 (High)61.2#13 (Claude Fable 5)
4GPT-6 Astra (High)56.5#5 (GPT-6 Astra)
5Gemini 3.7 Flash (High)55.3#20 (Gemini 3.7 Flash)
6Claude Opus 5 (High)50.6#11 (Claude Opus 5)
7DeepSeek V4 Pro (High)49.4#96 (DeepSeek V4 Pro)
8GPT-5.4 (High)41.2#76 (GPT-5.4)
9GPT-5.4 Mini (High)36.5#202 (GPT-5.4 Mini)
10Qwen 3.6 Plus (High)31.8#113 (Qwen 3.6 Plus)
11Claude Haiku 4.5 (High)23.5#271 (Claude Haiku 4.5)

No result here: #3 Claude Opus 5.5, #9 GPT-6.1 Sol, #10 Claude Sonnet 5.5.

Interactive version: theaggregate.ai/benchmark?slug=the-aggregate-exotic-fact-recall · How It Works · Data refreshed daily, snapshot 2026-10-11.