AGC-Bench - data_narrative — leaderboard

Metric: Dataset z-score. Source: huggingface.co. 83 models tracked.

Top models

#ModelScore
1GPT-5.11.45
2Kimi K2.51.42
3Claude Opus 4.71.4
4Mistral Medium 3.11.37
5Claude Opus 4.61.24
6GLM-5-Turbo1.21
7GLM-5.11.19
8Claude Opus 4.51.17
9Claude Sonnet 4.61.16
10Claude Sonnet 41.1
11Mistral Large 31.06
12GPT-5.41.06
13Kimi K2.61.02
14Claude Sonnet 4.51
15GPT-5.51

Interactive version: theaggregate.ai/benchmark?slug=agc-bench-data-narrative · How the rankings work · Data refreshed daily, snapshot 2026-07-22.