Llama 3.2 1B Instruct: benchmark results

Instruction-tuned Llama 3.2 1B checkpoint. Provider: Meta. Released 2024-09-25. Access: Open.

Unified ELO 1334 ± 1, rank #1295 of 1392 rated models, from 507 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Enkrypt AI - Jailbreak Risk3.22Risk Score85.3
Thai LLM NLG - xl_sum_tha_seacrowd_t2t (ROUGE1)31.06ROUGE183.6
Thai LLM NLG - xl_sum_tha_seacrowd_t2t (ROUGEL)21.33ROUGEL83.6
Enkrypt AI - Toxicity Risk1.18Risk Score79.8
Open LLM Leaderboard - IFEval58.1Score69.9
Thai LLM NLG - xl_sum_tha_seacrowd_t2t (ROUGE2)9.77ROUGE267.2
MERA - ruHumanEval18.72pass@1 (%)62.7
Thai LLM NLG - iapp_squad_seacrowd_qa (ROUGE1)46.39ROUGE162.7
Thai LLM NLG - iapp_squad_seacrowd_qa (ROUGEL)45.77ROUGEL62.7
BlueBench - Summarization17.62Score (%)58.8
LA Leaderboard - Spanish Law Exams31.09Accuracy (%)58.8
Thai LLM NLG - iapp_squad_seacrowd_qa (ROUGE2)32.43ROUGE258.2

Interactive version: theaggregate.ai/model?slug=llama-3-2-1b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.