Grok 4.1 (Thinking) — benchmark results

Provider: xAI. Released 2025-11-17. Access: API.

Unified ELO 1695 ± 79, rank #337 of 1806 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Chatbot Arena (Text)1466Elo89.8
CyBench39End-to-End % Solved62.5
LLM Stats Score16.52LLM Stats Score (conservative rating)42.1
PrinzBench25Score (x/99)28.6
Creative Writing v386.09Elo score (self-reported)7.4
Chatbot Arena (Code)1210Elo5.5
FigQA34Score (self-reported)0

Interactive version: theaggregate.ai/model?slug=grok-4-1-thinking · How It Works · Data refreshed daily, snapshot 2026-08-07.