EQ-Bench Longform Writing — leaderboard

Tests sustained creative writing across 8 sequential 1000-word chapters with brainstorming, revision cycles, and 14 quality dimensions including character development and plot coherence.

Metric: Writing Score (0-100). Source: eqbench.com. Status: saturation imminent. 123 models tracked.

Top models

#ModelScore
1Claude Fable 583
2Claude Opus 4.781.8
3GPT-5.6 Sol81.7
4Claude Opus 4.880.8
5Claude Sonnet 4.679.9
6Kimi K379.6
7Kimi K2.678.5
8GPT-5.478.3
9Claude Sonnet 578.3
10GPT-5.578.2
11GPT-5.6 Terra78
12GLM-5.277.9
13Claude Opus 4.677.7
14DeepSeek V4 Pro75.6
15GPT-5.6 Luna75.5

Interactive version: theaggregate.ai/benchmark?slug=eq-bench-longform-writing · How the rankings work · Data refreshed daily, snapshot 2026-07-22.