Grok 4.7: benchmark results

Provider: xAI. Access: API.

Unified ELO 1987 ± 16, rank #19 of 2622 rated models, from 36 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LLM Stats (SWE-Marathon)46Score (%)100
Next.js Agent Evals (OpenCode) - Success Rate94Evals passed, pass@4 (%)100
Vals AI Harvey Legal Agent Bench19.58Accuracy (%)93.5
LM Market Cap LMC Score88.8LMC Score (0-100)90
SvelteBench98.9Average pass@1 (%)87.9
RuneBench7892Total Peak XP Rate (XP/min)86.8
LLM Stats (DeepSWE 1.1)71Score (%)82.4
Vals AI Vibe Code Bench75.86Accuracy (%)80.9
Vals AI Terminal-Bench 2.176.03Accuracy (%)80
AI Chess Leaderboard (Continuation)957Elo79.5
AI Chess Leaderboard (Reasoning)894Elo73.4
Next.js Agent Evals (OpenCode) - Success Rate with AGENTS.md94Evals passed with bundled Next.js docs in AGENTS.md, pass@4 72.7

Interactive version: theaggregate.ai/model?slug=grok-4-7 · How It Works · Data refreshed daily, snapshot 2026-09-22.