Grok 4.6 (High): benchmark results

Provider: xAI. Released 2026-08-12. Access: API.

Unified ELO 1715 ± 1, rank #70 of 1761 rated models, from 93 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
OpenCompass Knowledge - Humanities95.8Score (%)100
AA GPQA Diamond94.95Accuracy (%)99.4
Tau3 Banking50.72Success Rate (%)99
Vals AI GPQA94.7Accuracy (%)98.5
Artificial Analysis Intelligence Index50.58Intelligence Index97.8
Chatbot Arena (Text - Chinese)1540Arena Score97.8
AA Omniscience30.48Score96.9
Vals AI SWE-bench Verified95.6Resolved (%)96.6
APEX-Agents-AA57.5Pass@1 (self-reported)96.4
Vals AI LiveCodeBench88.22Accuracy (%)95.8
WebDev Arena1628.84Arena Score95.7
AA GDPval1647.85ELO95.4

Interactive version: theaggregate.ai/model?slug=grok-4-6-high · How It Works · Data refreshed daily, snapshot 2026-09-05.