AutomationBench-AA - Finance - Raw Objective Completion: leaderboard

Metric: Raw Objective Completion (%). Source: artificialanalysis.ai. 167 models tracked.

Top models

#ModelScore
1Grok 4.6 (xHigh)92.16
2Grok 4.6 (High)91.74
3GLM-5.3 (Max)91.17
4Qwen3.8 2.4T A95B90.52
5Grok 4.6 (Medium)89.27
6GPT-6 (Max)89.24
7GLM-5.3 Flash88.9
8Grok 4.5 (High)87.66
9GPT-6 (xHigh)87.52
10Qwen3.8-Flash-Next87.46
11Claude Opus 5 (Adaptive Reasoning, Max Effort)87.38
12GPT-6 (Medium)87.26
13GPT-6 (High)87.18
14Qwen 3.8 Max (0902)87.18
15Gemini 3.7 Flash (High)86.02

Interactive version: theaggregate.ai/benchmark?slug=automationbench-aa-finance-raw-objective-completion · How It Works · Data refreshed daily, snapshot 2026-09-19.