Grok 3 Mini (Low): benchmark results

Grok 3 Mini evaluated at the low reasoning-effort setting. Provider: xAI. Released 2025-02-17. Access: API.

Unified ELO 1582 ± 1, rank #506 of 1761 rated models, from 24 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MATH Level 590.94Accuracy (%)80.6
Confabulation Leaderboard (Lechmazur)10.89Confabulation rate % (lower is better)77
Vals AI TaxEval v272.98Accuracy (%)61.8
Generalization V1 (Lechmazur)1.9Avg Rank (lower is better)55.6
NYT Connections Older Models14Score (%)53.6
Vals AI LegalBench81.92Accuracy (%)49.6
LLM Chess (Saplin)-33.9ELO49.1
Vals AI MGSM90.36Accuracy (%)47.7
OTIS Mock AIME 2024-2562.22Accuracy (%)46.9
Vals AI AIME70.62Accuracy (%)44.2
Vals AI MedQA88.65Accuracy (%)43.6
Vals AI CorpFin v259.48Accuracy (%)41.4

Interactive version: theaggregate.ai/model?slug=grok-3-mini-low · How It Works · Data refreshed daily, snapshot 2026-09-05.