AutomationBench-AA - Support - Raw Objective Completion: leaderboard

Metric: Raw Objective Completion (%). Source: artificialanalysis.ai. 167 models tracked.

Top models

#ModelScore
1GPT-6 (xHigh)92.43
2GPT-6 (Max)91.93
3GPT-6 (High)91.34
4Grok 4.6 (High)89.71
5GPT-5.6 Sol (Max)89.55
6Qwen 3.8 Max (0902)89.46
7Grok 4.6 (xHigh)89.41
8Claude Opus 5 (Adaptive Reasoning, Max Effort)89.28
9GPT-5.6 Sol (xHigh)88.71
10Grok 4.6 (Medium)88.61
11GLM-5.3 Flash88.36
12GLM-5.3 (Max)88.16
13Grok 4.5 (High)87.65
14GPT-6 (Medium)87.49
15Qwen3.8-Flash-Next87.29

Interactive version: theaggregate.ai/benchmark?slug=automationbench-aa-support-raw-objective-completion · How It Works · Data refreshed daily, snapshot 2026-09-19.