BrainBench (EEG) - CodeAct - Neurocognitive Assessment: leaderboard

Metric: EEG analysis score (0-100). Source: arxiv.org. 13 models tracked.

Top models

#ModelScore
1Claude Opus 570.03
2Qwen 3.7 Max (Non-reasoning)65.13
3GLM-5 (Non-reasoning)65.12
4Qwen 3.7 Plus (Non-reasoning)64.17
5GPT-5.6 Sol (Non-reasoning)63.36
6GPT-5.6 Terra (Non-reasoning)61.65
7DeepSeek V4 Flash (Non-reasoning)60.38
8MiniMax-M2.557.99
9Qwen 3.5 122B A10B (Non-reasoning)56.16
10Kimi K2.5 (Non-reasoning)55.33
11Qwen 3.5 35B A3B (Non-reasoning)51.04
12GPT-5.6 Luna (Non-reasoning)48.58

Interactive version: theaggregate.ai/benchmark?slug=brainbench-eeg-codeact-neurocognitive-assessment · How It Works · Data refreshed daily, snapshot 2026-09-19.