Artificial Analysis: leaderboard

Composite Intelligence Index (v4.0) aggregating 10 evaluations across Agents, Coding, General, and Scientific Reasoning - independently run by Artificial Analysis on 280+ models.

Metric: Intelligence Index. Source: artificialanalysis.ai. Status: years away from saturation. 630 models tracked.

Top models

#ModelScore
1Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback)56.76
2GPT-6 (Max)54.66
3GPT-6 (xHigh)54.31
4Claude Opus 5 (Adaptive Reasoning, Max Effort)54.05
5Claude Fable 5.1 (Adaptive Reasoning, Xhigh Effort, Default Fallback)53.8
6Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)53.37
7GPT-6 (High)53.36
8Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)53.19
9Muse Spark 1.3 (Max)52.95
10GPT-6 (Medium)52.25
11Claude Opus 5 (Adaptive Reasoning, High Effort)52.03
12Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback)51.67
13Muse Spark 1.3 (xHigh)51.55
14GPT-5.6 Sol (Max)51.26
15Grok 4.6 (High)50.58

Interactive version: theaggregate.ai/benchmark?slug=artificial-analysis · How It Works · Data refreshed daily, snapshot 2026-09-05.