AgentIdeaBench - Static - Originality: leaderboard

Metric: Originality Critic Score (1-10). Source: moyunxiang.com. 63 models tracked.

Top models

#ModelScore
1Claude Opus 57.25
2GPT-5.6 Sol7.13
3GPT-5.57.08
4GPT-5.6 Terra7.03
5GPT-5.6 Luna6.81
6GPT-56.67
7GPT-5.46.49
8GPT-5.26.42
9GPT-5.4 Mini6.4
10Claude Sonnet 56.21
11Claude Opus 4.76.14
12Gemini 3.5 Flash6.14
13Claude Opus 4.86.1
14GPT-5 Mini6.1
15GPT-5.16

Interactive version: theaggregate.ai/benchmark?slug=agentideabench-static-originality · How It Works · Data refreshed daily, snapshot 2026-09-19.