AIMultiple - FinanceReasoning (Hard): leaderboard

Metric: Accuracy (%, 238 hard FinanceReasoning questions). Source: aimultiple.com. 55 models tracked.

Top models

#ModelScore
1GPT-5.6 Pro Sol90.76
2GPT-5.6 Sol90.34
3Claude Fable 590.34
4Claude Fable 5.190.34
5Claude Opus 589.92
6Claude Opus 4.889.08
7Kimi K388.24
8Grok 4.588.24
9GPT-588.23
10Claude Opus 4.687.82
11GPT-5 Mini87.39
12GPT-687.39
13Gemini 3.5 Flash86.97
14GPT-5.6 Terra86.97
15Claude Sonnet 586.97

Interactive version: theaggregate.ai/benchmark?slug=aimultiple-financereasoning-hard · How It Works · Data refreshed daily, snapshot 2026-09-19.