llama-160m: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1199 ± 20, rank #2901 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR37.92Score29
Open LLM Leaderboard v1 - TruthfulQA MC242.08MC2 (%) (0-shot)19.2
Open LLM Leaderboard - GPQA26.17Score15.6
Open LLM Leaderboard v1 - GSM8K0.08Accuracy (%) (5-shot)9.5
Open LLM Leaderboard - IFEval17.91Score9.2
Open LLM Leaderboard v1 - HellaSwag35.23Normalized accuracy (%) (10-shot)7.1
Open LLM Leaderboard - MATH Level 50.83Score6
Open LLM Leaderboard - MMLU-Pro11.28Score4.4
Open LLM Leaderboard v1 - WinoGrande50.83Accuracy (%) (5-shot)4.4
Open LLM Leaderboard v1 - ARC Challenge24.83Normalized accuracy (%) (25-shot)4.2
Open LLM Leaderboard v1 - MMLU24.26Accuracy (%) (5-shot)3.4
Open LLM Leaderboard - BBH28.88Score1.7

Interactive version: theaggregate.ai/model?slug=llama-160m · How It Works · Data refreshed daily, snapshot 2026-09-23.