WideSearch: leaderboard

Agentic search benchmark focused on broad, parallel information gathering, where agents must cover many sources and synthesize the findings.

Metric: Score (%). Source: llm-stats.com. Status: saturation imminent. 11 models tracked.

Top models

#ModelScore
1Hy4 preview83.9
2Qwen 3.8 Max81.9
3Kimi K2.680.8
4Kimi K2.579
5Hy376.4
6Qwen 3.6 Plus74.3
7Qwen 3.5 397B A17B74
8Qwen 3.5 27B61.1
9Qwen 3.5 122B A10B60.5
10Qwen 3.6 35B A3B60.1
11Qwen 3.5 35B A3B57.1

Interactive version: theaggregate.ai/benchmark?slug=widesearch · How It Works · Data refreshed daily, snapshot 2026-09-05.