Rogo Big Finance Bench: leaderboard

Vendor-reported 928-question finance-agent benchmark spanning vertical-specific skills, metrics, financial-statement analysis, and forecasting workflows.

Metric: Rubric Score (self-reported). Source: benchmarklist.com. Status: years away from saturation. 14 models tracked.

Top models

#ModelScore
1Claude Sonnet 4.659
2Claude Opus 4.759
3GLM-5.155
4GPT-5.6 Sol53
5GPT-5.6 Terra51
6GPT-5.549
7Qwen 3.6 27B47
8Kimi K245
9Claude Opus 4.844
10Gemini 3 Flash43
11Gemini 3.1 Pro (Preview)41
12GPT-5.6 Luna36
13GPT-5.4 Mini22

Interactive version: theaggregate.ai/benchmark?slug=rogo-big-finance-bench · How It Works · Data refreshed daily, snapshot 2026-09-05.