Grok 4.6 (xHigh): benchmark results

Provider: xAI. Released 2026-08-12. Access: API.

Unified ELO 1724 ± 1, rank #59 of 1761 rated models, from 47 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Epoch AI - Dtbench97.33Score98.8
AA GPQA Diamond93.54Accuracy (%)97.3
CursorBench 3.170.8Score (%)97.3
AA GDPval1667.19ELO97
Artificial Analysis Intelligence Index49.34Intelligence Index97
AA Omniscience29.32Score96.5
OTIS Mock AIME 2024-2599.17Accuracy (%)96.5
AA Humanity's Last Exam44.07Accuracy (%)95.2
HANDBOOK.md Agents27.3Score (%)93
AA Long Context Reasoning81Accuracy (%)92.6
AA CritPt19.71Accuracy (%)92.2
VoxelBench2068Rating91.5

Interactive version: theaggregate.ai/model?slug=grok-4-6-xhigh · How It Works · Data refreshed daily, snapshot 2026-09-05.