Llama 3.2 3B Instruct: benchmark results

Meta Llama 3.2 3B instruction-tuned checkpoint. Provider: Meta. Released 2024-09-25. Access: Open.

Unified ELO 1392 ± 1, rank #1170 of 1392 rated models, from 665 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AGC-Bench - creatset1.63Dataset z-score98.8
LA Leaderboard - Spanish Law Exams40.34Accuracy (%)93.4
LA Leaderboard57.84Average Score (%)89.7
Open LLM Leaderboard - IFEval73.93Score88.7
LA Leaderboard - AQuAS69.77Accuracy (%)88.2
Thai LLM NLG - xl_sum_tha_seacrowd_t2t (ROUGEL)21.73ROUGEL88.1
EuroEval Dutch Summarization - Wiki Lingua NL34.77Score (%)86.7
Thai LLM NLG - xl_sum_tha_seacrowd_t2t (ROUGE1)31.23ROUGE186.6
EuroEval Catalan Summarization - Dacsa CA37.99Score (%)86.4
AGC-Bench - sdat0.54Dataset z-score85.2
Thai LLM NLG - xl_sum_tha_seacrowd_t2t (ROUGE2)10.86ROUGE285.1
Thai LLM NLG - iapp_squad_seacrowd_qa (ROUGE2)47.74ROUGE280.6

Interactive version: theaggregate.ai/model?slug=llama-3-2-3b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.