CAIS Text Capabilities Index: leaderboard

Composite CAIS AI Dashboard text index averaging Humanity's Last Exam, ARC-AGI-2, TextQuests, and SWE-bench Pro for models with all component scores.

Metric: Text Capabilities Index (self-reported). Source: benchmarklist.com. Status: saturation imminent. 40 models tracked.

Top models

#ModelScore
1GPT-5.555.9
2Claude Opus 4.853.8
3Gemini 3.1 Pro (Preview)52.9
4GPT-5.449.3
5Gemini 3.5 Flash48.9
6Claude Opus 4.746.9
7Claude Opus 4.644
8Gemini 3 Pro38.4
9Claude Opus 4.536.6
10Gemini 3 Flash35.6
11GPT-5.233.8
12Kimi K2.632.8
13Claude Sonnet 4.632.6
14Grok 4.2032.5
15DeepSeek V4 Pro32.1

Interactive version: theaggregate.ai/benchmark?slug=cais-text-capabilities-index · How It Works · Data refreshed daily, snapshot 2026-09-05.