FutureSearch DRB - Find Dataset — leaderboard

Metric: Average Score. Source: evals.futuresearch.ai. 22 models tracked.

Top models

#ModelScore
1Claude Opus 4.10.71
2GPT-50.67
3Grok 40.67
4GPT-5.50.63
5Claude Opus 4.50.63
6Claude Opus 40.63
7Claude Opus 4.60.6
8Gemini 3 Flash0.59
9Claude Sonnet 4.50.58
10Claude Sonnet 40.58
11Claude Sonnet 4.60.56
12Claude Haiku 4.50.54
13Gemini 2.5 Pro0.52
14Gemini 3.1 Pro (Preview)0.52
15GPT-5.20.52

Interactive version: theaggregate.ai/benchmark?slug=futuresearch-drb-find-dataset · How the rankings work · Data refreshed daily, snapshot 2026-07-22.