Llama-3.1-Argunaut-1-8B-SFT — benchmark results

Provider: Meta. Released 2024-12-31. Access: Open.

Unified ELO 1348 ± 42, rank #1424 of 1776 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR15.85Score84.1
Open LLM Leaderboard - IFEval55.19Score66.7
Open LLM Leaderboard - MATH Level 514.5Score61
Open CoT - LSAT Reading Comprehension13.75CoT Gain (%)57.6
Open LLM Leaderboard - MMLU-Pro27.47Score50.6
Open LLM Leaderboard - BBH27.19Score43.1
Open CoT - LSAT Analytical Reasoning3.04CoT Gain (%)41.2
Open LLM Leaderboard - GPQA4.47Score38.5
Open CoT Leaderboard4.6Average CoT Gain (%)28.2
Open CoT - LSAT Logical Reasoning3.92CoT Gain (%)17.9
Open CoT - LogiQA1.44CoT Gain (%)17.2
Open CoT - LogiQA 20.83CoT Gain (%)10.7

Interactive version: theaggregate.ai/model?slug=llama-3-1-argunaut-1-8b-sft · How the rankings work · Data refreshed daily, snapshot 2026-07-22.