Grok 3 Mini (Low) — benchmark results

Grok 3 Mini evaluated at the low reasoning-effort setting. Provider: xAI. Released 2025-02-17. Access: API.

Unified ELO 1582 ± 31, rank #527 of 1776 rated models, from 25 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MATH Level 590.94Accuracy (%)80.6
Confabulation Leaderboard (Lechmazur)10.89Confabulation rate % (lower is better)77
Vals AI TaxEval v272.98Accuracy (%)64.8
Generalization V1 (Lechmazur)1.9Avg Rank (lower is better)55.6
LLM Chess (Saplin)-33.9ELO55
Vals AI LegalBench81.92Accuracy (%)54.4
NYT Connections Older Models26Score (%)51.4
OTIS Mock AIME 2024-2562.22Accuracy (%)49.4
Vals AI CorpFin v259.48Accuracy (%)44.3
Vals AI AIME70.62Accuracy (%)44.2
Vals AI MGSM90.36Accuracy (%)44
Vals AI MedQA88.65Accuracy (%)43.6

Interactive version: theaggregate.ai/model?slug=grok-3-mini-low · How the rankings work · Data refreshed daily, snapshot 2026-07-22.