AutomationBench-AA - Marketing - Raw Objective Completion: leaderboard

Metric: Raw Objective Completion (%). Source: artificialanalysis.ai. 167 models tracked.

Top models

#ModelScore
1Claude Opus 5 (Adaptive Reasoning, Max Effort)90.76
2Qwen3.8-Flash-Next89.1
3Qwen3.8 2.4T A95B88.86
4Qwen 3.8 Max (0902)87.91
5Grok 4.6 (Medium)87.22
6GLM-5.3 (Max)86.98
7GPT-5.6 Sol (xHigh)86.91
8GPT-5.6 Terra (Max)86.67
9Grok 4.6 (High)86.6
10GPT-5.6 Sol (Max)85.91
11Grok 4.6 (xHigh)85.72
12Gemini 3.7 Flash (High)84.89
13GPT-6 (High)84.42
14GPT-5.6 Sol (High)84.3
15GPT-6 (Low)83.92

Interactive version: theaggregate.ai/benchmark?slug=automationbench-aa-marketing-raw-objective-completion · How It Works · Data refreshed daily, snapshot 2026-09-19.