FutureSearch DRB — leaderboard

Metric: Average Score. Source: evals.futuresearch.ai. 22 models tracked.

Top models

#ModelScore
1Claude Opus 4.60.55
2Claude Sonnet 4.60.55
3Claude Opus 4.50.55
4GPT-5.50.54
5Claude Opus 4.80.5
6Gemini 3 Flash0.5
7GPT-50.5
8Claude Opus 4.10.48
9Gemini 3.1 Pro (Preview)0.48
10Claude Sonnet 4.50.48
11Grok 40.47
12Claude Opus 40.47
13Claude Sonnet 40.47
14Gemini 3 Pro0.46
15Claude Haiku 4.50.46

Interactive version: theaggregate.ai/benchmark?slug=futuresearch-drb · How the rankings work · Data refreshed daily, snapshot 2026-07-22.