Grok 4.3 (Medium) — benchmark results

Provider: xAI. Released 2026-04-30. Access: API.

Unified ELO 1764 ± 22, rank #208 of 1806 rated models, from 34 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA IFBench83.33Accuracy (%)100
AA Omniscience16.7Score94.6
AA GPQA Diamond88.99Accuracy (%)90.2
AA Humanity's Last Exam29.98Accuracy (%)86.6
AA TAU-2 Bench91.23Accuracy (%)86.1
AA Omniscience - Software Engineering (SWE) - C69Accuracy (%)84.8
Chess Bench LLM1248Lichess Rating84.5
AA CritPt4.86Accuracy (%)83.7
Epoch AI - Scicode44.56Score83.3
Artificial Analysis Intelligence Index36.92Intelligence Index83.2
AA Omniscience - Software Engineering (SWE) - TypeScript51.11Accuracy (%)81.7
AA Omniscience - Software Engineering (SWE) - JavaScript52.73Accuracy (%)81.6

Interactive version: theaggregate.ai/model?slug=grok-4-3-medium · How It Works · Data refreshed daily, snapshot 2026-08-07.