EQ-Bench Longform Writing: leaderboard

Tests sustained creative writing across 8 sequential 1000-word chapters with brainstorming, revision cycles, and 14 quality dimensions including character development and plot coherence.

Metric: Writing Score (0-100). Source: eqbench.com. Status: saturation imminent. 130 models tracked.

Top models

#ModelScore
1Claude Opus 586.3
2Claude Fable 583
3Claude Opus 4.781.8
4GLM-5.381.8
5GPT-5.6 Sol81.7
6Muse Spark 1.281.5
7Claude Opus 4.880.8
8Claude Sonnet 4.679.9
9GLM-5.3 Flash79.9
10Kimi K379.6
11Kimi K2.678.5
12GPT-5.478.3
13Claude Sonnet 578.3
14GPT-5.578.2
15GPT-5.6 Terra78

Interactive version: theaggregate.ai/benchmark?slug=eq-bench-longform-writing · How It Works · Data refreshed daily, snapshot 2026-09-05.