AgentIdeaBench - Active - Impact: leaderboard

Metric: Impact Critic Score (1-10). Source: moyunxiang.com. 63 models tracked.

Top models

#ModelScore
1Claude Opus 56.75
2GPT-5.6 Sol6.4
3GPT-5.6 Terra6.32
4Claude Opus 4.86.3
5Claude Opus 4.76.3
6GPT-5.56.28
7Claude Sonnet 56.22
8GPT-5.46.15
9GPT-5.26.06
10GPT-5.6 Luna6
11Gemini 3 Flash (Preview)5.93
12GPT-55.91
13GPT-5 Mini5.91
14GLM-5.15.9
15GPT-5.4 Mini5.87

Interactive version: theaggregate.ai/benchmark?slug=agentideabench-active-impact · How It Works · Data refreshed daily, snapshot 2026-09-19.