ActTraitBench: leaderboard

Metric: G_KD (Global Knowledge-Decision Gap) (self-reported). Source: benchmarklist.com. 15 models tracked.

Top models

#ModelScore
1MiniMax-M2.52.17
2Gemini 3.1 Pro (Preview)1.83
3GLM-51.79
4Qwen 3 235B A22B (Thinking)1.54
5Qwen 3 32B0.85
6DeepSeek V3.10.75
7DeepSeek V4 Flash0.65
8DeepSeek V3.20.59
9DeepSeek V4 Pro0.57
10Claude Sonnet 4.60.51
11DeepSeek V30.47
12GPT-4o0.28
13Qwen 3 8B0.23
14Qwen 3 1.7B0.19

Interactive version: theaggregate.ai/benchmark?slug=acttraitbench · How It Works · Data refreshed daily, snapshot 2026-09-05.