FrontierFinance - Financial Data & Modeling: leaderboard

Metric: Rubric qualification rate (%, macro average over queries, three-judge majority vote). Source: research.samaya.ai. Saturation forecast: Around June 2028. 11 models tracked.

Top models

#ModelScore
1Claude Fable 5.1 (High)60.94
2Gemini 3.6 Flash (Medium)56.23
3Claude Fable 5 (High)55.56
4Claude Opus 4.8 (High)50.96
5GPT-5.6 Sol (Medium)48.95
6GPT-5.5 (Medium)47.6
7GLM-5.2 (Max)47.53
8Kimi K3 (Max)46.51
9DeepSeek V4 Pro (High)45.3
10Gemini 3.1 Pro (Preview) (High)31.36
11Kimi K2.628.82

Interactive version: theaggregate.ai/benchmark?slug=frontierfinance-financial-data-modeling · How It Works · Data refreshed daily, snapshot 2026-09-26.