AgentIdeaBench - Active - Clarity: leaderboard

Metric: Clarity Critic Score (1-10). Source: moyunxiang.com. 63 models tracked.

Top models

#ModelScore
1Claude Opus 57.87
2GPT-5.6 Sol7.78
3GPT-5.6 Terra7.71
4Claude Opus 4.77.7
5GPT-5.27.6
6Claude Opus 4.87.6
7Claude Sonnet 57.59
8GPT-57.51
9GPT-5.57.51
10GPT-5 Mini7.43
11GPT-5.6 Luna7.41
12GPT-5.47.39
13O37.38
14GLM-5.17.37
15Claude Opus 4.67.22

Interactive version: theaggregate.ai/benchmark?slug=agentideabench-active-clarity · How It Works · Data refreshed daily, snapshot 2026-09-19.