Llama-3.1-SuperNova-Lite — benchmark results

Arcee AI's Llama 3.1 8B distilled from Llama 3.1 405B Instruct logits, tuned for strong instruction following at low cost. Provider: Meta. Released 2024-09-10. Access: Open.

Unified ELO 1515 ± 20, rank #749 of 1776 rated models, from 24 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EVALITA - faq54.89CPS97.9
Open CoT - LSAT Analytical Reasoning13.91CoT Gain (%)97.7
Open LLM Leaderboard - IFEval80.17Score97.5
EVALITA - evalita NER39.49CPS95.7
Open CoT - LSAT Logical Reasoning20.59CoT Gain (%)95
Open Korean LLM Leaderboard581.24Average Score (%)93
Open CoT Leaderboard13.97Average CoT Gain (%)91.6
Open CoT - LogiQA 212.66CoT Gain (%)81.3
Open CoT - LSAT Reading Comprehension18.22CoT Gain (%)77.5
EVALITA - sentiment-analysis75.24CPS72.3
Open LLM Leaderboard - MMLU-Pro31.97Score69.5
Open LLM Leaderboard - MATH Level 518.28Score68

Interactive version: theaggregate.ai/model?slug=llama-3-1-supernova-lite · How the rankings work · Data refreshed daily, snapshot 2026-07-22.