Llama-3.1-SuperNova-Lite: benchmark results

Arcee AI's Llama 3.1 8B distilled from Llama 3.1 405B Instruct logits, tuned for strong instruction following at low cost. Provider: Meta. Released 2024-09-10. Access: Open.

Unified ELO 1531 ± 1, rank #541 of 1392 rated models, from 24 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EVALITA - faq54.89CPS97.9
Open CoT - LSAT Analytical Reasoning13.91CoT Gain (%)97.7
Open LLM Leaderboard - IFEval80.17Score97.5
Open Korean LLM Leaderboard48.88Average Score (%)96.4
EVALITA - evalita NER39.49CPS95.7
Open CoT - LSAT Logical Reasoning20.59CoT Gain (%)95
Open CoT Leaderboard13.97Average CoT Gain (%)91.6
Open CoT - LogiQA 212.66CoT Gain (%)81.3
Open CoT - LSAT Reading Comprehension18.22CoT Gain (%)77.5
EVALITA - sentiment-analysis75.24CPS72.3
Open LLM Leaderboard - MMLU-Pro31.97Score69.5
Open LLM Leaderboard - MATH Level 518.28Score67.9

Interactive version: theaggregate.ai/model?slug=llama-3-1-supernova-lite · How It Works · Data refreshed daily, snapshot 2026-09-05.