AutomationBench-AA - Sales - Raw Objective Completion: leaderboard

Metric: Raw Objective Completion (%). Source: artificialanalysis.ai. 167 models tracked.

Top models

#ModelScore
1Grok 4.6 (xHigh)87.62
2Claude Opus 5 (Adaptive Reasoning, Max Effort)86.9
3Grok 4.5 (High)86.55
4GPT-6 (Max)85.91
5Grok 4.6 (Medium)85.91
6Grok 4.6 (High)85.28
7GPT-6 (High)84.61
8GPT-6 (xHigh)84.44
9GPT-6 (Medium)84.3
10GLM-5.3 Flash84.27
11Qwen3.8-Flash-Next84.09
12Qwen 3.8 Max (0902)83.43
13Grok 4.6 (Low)82.36
14GPT-5.6 Sol (Max)81.93
15GLM-5.3 (Max)81.78

Interactive version: theaggregate.ai/benchmark?slug=automationbench-aa-sales-raw-objective-completion · How It Works · Data refreshed daily, snapshot 2026-09-19.