Llama 3.2 1B Instruct — benchmark results

Instruction-tuned Llama 3.2 1B checkpoint. Provider: Meta. Released 2024-09-25. Access: Open.

Unified ELO 1207 ± 13, rank #1681 of 1776 rated models, from 438 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Japanese LLM - Wikicorpus J TO E Bleu EN36.92Score (%)97.8
Open Japanese LLM - ALT J TO E Bleu EN19.03Score (%)91.8
Open LLM Leaderboard - IFEval58.1Score69.9
BlueBench - Summarization17.62Score (%)58.8
LA Leaderboard - Spanish Law Exams31.09Accuracy (%)58.8
EuroEval German Summarization - Mlsum DE31.75Score (%)48.6
LA Leaderboard - EusExams Basque29.77Accuracy (%)44.7
HELMET (128K)25Average Score42.7
EuroEval Serbian Summarization - LR SUM SR24.26Score (%)42.2
Open LLM Leaderboard - MATH Level 58.23Score41.7
EuroEval Bosnian Summarization - LR SUM BS23.94Score (%)40.8
EuroEval Albanian NLU - ScaLA SQ3.45Linguistic acceptability Score (%)40.5

Interactive version: theaggregate.ai/model?slug=llama-3-2-1b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.