Grok 4.3 (Non-reasoning): benchmark results
Provider: xAI. Released 2026-04-30. Access: API.
Unified ELO 1567 ± 1, rank #571 of 1761 rated models, from 21 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AA Omniscience - Law | 20.9 | Accuracy (%) | 71.7 |
| AA Omniscience - Business | 21.2 | Accuracy (%) | 65.9 |
| Artificial Analysis Intelligence Index | 17.49 | Intelligence Index | 62.7 |
| AA Omniscience - Humanities & Social Sciences | 23.52 | Accuracy (%) | 60.4 |
| AA Omniscience - Software Engineering (SWE) | 32 | Accuracy (%) | 60.2 |
| AA TAU-2 Bench | 65.79 | Accuracy (%) | 59.9 |
| AA-Omniscience Accuracy | 23.72 | Accuracy (%) | 59.8 |
| AA Terminal-Bench Hard | 18.94 | Accuracy (%) | 58.7 |
| AA IFBench | 47.62 | Accuracy (%) | 56.3 |
| AA Omniscience | -33.08 | Score | 54.2 |
| AA GDPval | 1035.32 | ELO | 48.9 |
| AA Omniscience - Health | 19.32 | Accuracy (%) | 45.4 |
Interactive version: theaggregate.ai/model?slug=grok-4-3-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.