AgentIdeaBench - Static - Clarity: leaderboard

Metric: Clarity Critic Score (1-10). Source: moyunxiang.com. 63 models tracked.

Top models

#ModelScore
1GPT-5.6 Sol7.79
2GPT-5.6 Terra7.69
3GPT-5.6 Luna7.68
4Claude Opus 57.57
5GPT-57.56
6GPT-5.57.41
7GPT-5.47.17
8GPT-5.27.13
9Claude Sonnet 56.93
10Claude Opus 4.76.92
11Claude Opus 4.66.91
12O36.86
13GPT-5.4 Mini6.81
14Gemini 3.5 Flash6.79
15GPT-5 Mini6.78

Interactive version: theaggregate.ai/benchmark?slug=agentideabench-static-clarity · How It Works · Data refreshed daily, snapshot 2026-09-19.