Open LLM Leaderboard v1 - ARC Challenge: leaderboard
Metric: Normalized accuracy (%) (25-shot). Source: huggingface.co. Saturation forecast: Estimated already saturated. 7252 models tracked.
Top models
| # | Model | Score |
|---|---|---|
| 1 | free-evo-qwen72B-v0.8-re | 79.86 |
| 2 | Rhea-72B-v0.5 | 79.78 |
| 3 | Le_Triomphant-ECE-TW3 | 78.5 |
| 4 | luxia-21.4B-alignment-v1.2 | 77.73 |
| 5 | UNA-ThePitbull-21.4B-v2 | 77.73 |
| 6 | final_model_test_v2 | 77.73 |
| 7 | Smaug-72B-v0.1 | 76.02 |
| 8 | Myrrh_solar_10.7b_3.0 | 75.43 |
| 9 | Truthful_DPO_TomGrc_FusionNet_7Bx2_MoE_13B | 74.91 |
| 10 | LLaMAntino-3-ANITA-8B-Inst-DPO-ITA | 74.57 |
| 11 | UNA-SimpleSmaug-34B-v1beta | 74.57 |
| 12 | Luminex-34B-v0.2 | 74.49 |
| 13 | LogoS-7Bx2-MoE-13B-v0.2 | 74.4 |
| 14 | DARE_TIES_13B | 74.32 |
| 15 | MoE_13B_DPO | 74.32 |
Interactive version: theaggregate.ai/benchmark?slug=open-llm-leaderboard-v1-arc-challenge · How It Works · Data refreshed daily, snapshot 2026-09-23.