ARC1: benchmark results

Provider: Other. Access: Open.

Unified ELO 1476 ± 20, rank #1502 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K69.83Accuracy (%) (5-shot)90.6
Open LLM Leaderboard v1 - MMLU65.73Accuracy (%) (5-shot)85.2
Open LLM Leaderboard v1 - TruthfulQA MC252.73MC2 (%) (0-shot)57.2
Open LLM Leaderboard - GPQA29.45Score49.7
Open LLM Leaderboard v1 - WinoGrande76.64Accuracy (%) (5-shot)49.6
Open LLM Leaderboard - MMLU-Pro33.71Score48.1
Open LLM Leaderboard - IFEval44.11Score47.7
Open LLM Leaderboard - BBH49.03Score44.6
Open LLM Leaderboard - MuSR39.91Score41.1
Open LLM Leaderboard v1 - ARC Challenge58.79Normalized accuracy (%) (25-shot)40.9
Open LLM Leaderboard - MATH Level 56.87Score36.9
Open LLM Leaderboard v1 - HellaSwag76.41Normalized accuracy (%) (10-shot)28.6

Interactive version: theaggregate.ai/model?slug=arc1 · How It Works · Data refreshed daily, snapshot 2026-09-23.