Open FinLLM Leaderboard — leaderboard

Open financial-language-model leaderboard from FINOS, covering broad financial NLP and reasoning task categories.

Metric: Average normalized score (self-reported). Source: benchmarklist.com. Status: saturation imminent. 25 models tracked.

Top models

#ModelScore
1plutus-8B-instruct55.9
2GPT-448.34
3GPT-4.543.4
4Qwen 2.5 32B Instruct42.49
5Qwen 2.5 72B Instruct41.36
6GPT-4o37.51
7Llama 3 70B Instruct31.23
8Llama-Krikri-8B-Instruct30.79
9DeepSeek V329.49
10GPT-4o Mini28.32
11GPT-3.5 Turbo23.16
12Llama 3.1 8B Instruct22.72
13Gemma 2 27B19.81
14Llama 3 8B Instruct18.93
15Qwen 2.5 7B Instruct17.37

Interactive version: theaggregate.ai/benchmark?slug=open-finllm-leaderboard · How the rankings work · Data refreshed daily, snapshot 2026-07-22.