Grok 4.3 (Medium): benchmark results

Provider: xAI. Released 2026-04-30. Access: API.

Unified ELO 1677 ± 1, rank #203 of 3081 rated models, from 46 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA IFBench83.33Accuracy (%)100
IFBench83.33Score (%)100
AA-Omniscience Hallucination Rate16.94Hallucination Rate (%)99.1
AA-Omniscience Index - Health9.1Omniscience Index95.1
AA-Omniscience Index - Business13.1Omniscience Index92.5
AA-Omniscience Index - Law15.8Omniscience Index92
AA-Omniscience Index - Science, Engineering & Mathematics14.3Omniscience Index91.8
AA-Omniscience Index - Humanities & Social Sciences17.1Omniscience Index91.7
AA Omniscience16.7Score91.1
AA-Omniscience Index - Software Engineering (SWE) - TypeScript44.44Omniscience Index87.6
AA-Omniscience Index - Software Engineering (SWE) - R22Omniscience Index87.3
AA-Omniscience Index - Software Engineering (SWE) - Java7Omniscience Index87.1

Interactive version: theaggregate.ai/model?slug=grok-4-3-medium · How It Works · Data refreshed daily, snapshot 2026-09-21.