FutureSearch DRB - Find Original Source — leaderboard

Metric: Average Score. Source: evals.futuresearch.ai. 22 models tracked.

Top models

#ModelScore
1GPT-5.50.59
2Claude Opus 4.50.59
3Claude Opus 4.80.5
4Claude Opus 4.60.5
5Claude Sonnet 4.60.46
6Gemini 3.1 Pro (Preview)0.41
7GPT-50.41
8Claude Sonnet 40.41
9Claude Haiku 4.50.41
10Grok 40.41
11Gemini 3 Flash0.41
12Claude Opus 40.41
13Claude Sonnet 4.50.4
14GPT-5.10.36
15O30.36

Interactive version: theaggregate.ai/benchmark?slug=futuresearch-drb-find-original-source · How the rankings work · Data refreshed daily, snapshot 2026-07-22.