AgentIdeaBench - Static - Impact: leaderboard

Metric: Impact Critic Score (1-10). Source: moyunxiang.com. 63 models tracked.

Top models

#ModelScore
1Claude Opus 56.67
2GPT-5.6 Sol6.51
3GPT-5.6 Terra6.42
4GPT-5.56.35
5GPT-5.6 Luna6.2
6GPT-56.18
7GPT-5.25.68
8Claude Sonnet 55.65
9GPT-5.45.65
10GPT-5.4 Mini5.61
11GPT-5 Nano5.53
12Gemini 3.5 Flash5.5
13GPT-5 Mini5.5
14Claude Opus 4.75.5
15GPT-5.15.42

Interactive version: theaggregate.ai/benchmark?slug=agentideabench-static-impact · How It Works · Data refreshed daily, snapshot 2026-09-19.