Grok 4.6 (High): benchmark results
Provider: xAI. Released 2026-08-12. Access: API.
Unified ELO 1715 ± 1, rank #70 of 1761 rated models, from 93 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| OpenCompass Knowledge - Humanities | 95.8 | Score (%) | 100 |
| AA GPQA Diamond | 94.95 | Accuracy (%) | 99.4 |
| Tau3 Banking | 50.72 | Success Rate (%) | 99 |
| Vals AI GPQA | 94.7 | Accuracy (%) | 98.5 |
| Artificial Analysis Intelligence Index | 50.58 | Intelligence Index | 97.8 |
| Chatbot Arena (Text - Chinese) | 1540 | Arena Score | 97.8 |
| AA Omniscience | 30.48 | Score | 96.9 |
| Vals AI SWE-bench Verified | 95.6 | Resolved (%) | 96.6 |
| APEX-Agents-AA | 57.5 | Pass@1 (self-reported) | 96.4 |
| Vals AI LiveCodeBench | 88.22 | Accuracy (%) | 95.8 |
| WebDev Arena | 1628.84 | Arena Score | 95.7 |
| AA GDPval | 1647.85 | ELO | 95.4 |
Interactive version: theaggregate.ai/model?slug=grok-4-6-high · How It Works · Data refreshed daily, snapshot 2026-09-05.