Conceptual Reasoning Index - Consistency (ACCoRD): leaderboard

Metric: Chance-Corrected Score (0-100). Source: conceptualreasoning.ai. 135 models tracked.

Top models

#ModelScore
1Claude Fable 584.95
2Claude Opus 581.95
3GPT-5.580.51
4Claude Opus 4.680.42
5GPT-5.479.97
6Claude Opus 4.779.84
7GPT-5.279.25
8Claude Opus 4.579.14
9GPT-5.6 Pro Sol78.86
10Muse Spark 1.178.37
11Claude Opus 4.877.37
12Muse Spark 1.277.37
13Gemini 3.7 Flash76.98
14GPT-5.6 Sol75.91
15GPT-5.5 Pro75.83

Interactive version: theaggregate.ai/benchmark?slug=conceptual-reasoning-index-consistency-accord · How It Works · Data refreshed daily, snapshot 2026-09-05.