Grok 4.20 Beta (0309) (Non-reasoning): benchmark results

Provider: xAI. Released 2026-03-09. Access: API.

Unified ELO 1496 ± 1, rank #1490 of 3078 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI - Natural Intelligence39.77NatInt Score86.3
UGI - Writing43.88Writing Score83.8
UGI Leaderboard30.25UGI Score31.7
UGI - Willingness (W/10)4W/10 Score30.6
ForecastBench Baseline - Zero-Shot - Dataset54.3Dataset Brier Index (difficulty-adjusted, higher is better)11.4
ForecastBench Baseline - Zero-Shot - Market52.4Market Brier Index (difficulty-adjusted, higher is better)5.7
ForecastBench Baseline - Zero-Shot - Overall53.3Overall Brier Index (difficulty-adjusted, higher is better)5.1
ForecastBench54.9Overall Score (higher is better)0.9
ForecastBench Tournament - Market55.4Market Brier Index (difficulty-adjusted, higher is better)0.5

Interactive version: theaggregate.ai/model?slug=grok-4-20-beta-0309-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-19.