Grok 4.20 (Non-reasoning): benchmark results

Grok 4.20 evaluated with reasoning disabled. Provider: xAI. Released 2026-03-10. Access: API.

Unified ELO 1587 ± 1, rank #486 of 1761 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
BenchTable58.7Total Score (%)68.6
Design Arena (Website)1235Elo66.8
Design Arena (Data Viz)1220Elo65.1
ZeroBench10Score (%)64.5
Design Arena (UI Components)1209Elo59.7
Design Arena (Game Dev)1205Elo58.8
Design Arena (3D)1190Elo56.8
AI Chess Leaderboard (Reasoning)664Elo47.7
CLBench17.7Solving Rate (%)45.7
Design Arena (ASCII Art)1152Elo36.6
Opper TaskBench82Avg Task Score (%)33.5
LLM Chess (Saplin)-125ELO32.3

Interactive version: theaggregate.ai/model?slug=grok-4-20-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.