Llama 3.2 3B Instruct — benchmark results

Meta Llama 3.2 3B instruction-tuned checkpoint. Provider: Meta. Released 2024-09-25. Access: Open.

Unified ELO 1368 ± 8, rank #1351 of 1776 rated models, from 587 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AGC-Bench - creatset1.63Dataset z-score98.8
LA Leaderboard - Spanish Law Exams40.34Accuracy (%)93.4
LA Leaderboard57.84Average Score (%)89.7
Open LLM Leaderboard - IFEval73.93Score88.7
LA Leaderboard - AQuAS69.77Accuracy (%)88.2
EuroEval Dutch Summarization - Wiki Lingua NL34.77Score (%)86.7
EuroEval Catalan Summarization - Dacsa CA37.99Score (%)86.4
AGC-Bench - sdat0.54Dataset z-score85.2
AGC-Bench - ocw_connections0.92Dataset z-score79.3
EuroEval Serbian Summarization - LR SUM SR29.29Score (%)75.5
EuroEval Norwegian Summarization - NO Sammendrag30.05Score (%)75
TinyQABenchmark (core-en)84.6Exact Match75

Interactive version: theaggregate.ai/model?slug=llama-3-2-3b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.