BrainBench (EEG) - CodeAct - Overall: leaderboard

Metric: Difficulty-weighted EEG analysis score (0-100). Source: arxiv.org. 13 models tracked.

Top models

#ModelScore
1Claude Opus 576.25
2GPT-5.6 Sol (Non-reasoning)69.79
3Qwen 3.7 Max (Non-reasoning)65.72
4GLM-5 (Non-reasoning)64.33
5GPT-5.6 Terra (Non-reasoning)61.97
6Qwen 3.7 Plus (Non-reasoning)61.55
7DeepSeek V4 Flash (Non-reasoning)61.02
8MiniMax-M2.558.85
9Kimi K2.5 (Non-reasoning)58.06
10Qwen 3.5 122B A10B (Non-reasoning)52.32
11GPT-5.6 Luna (Non-reasoning)48.64
12Qwen 3.5 35B A3B (Non-reasoning)44.61

Interactive version: theaggregate.ai/benchmark?slug=brainbench-eeg-codeact-overall · How It Works · Data refreshed daily, snapshot 2026-09-19.