Llama 3 8B Instruct: benchmark results

Meta Llama 3 8B instruction-tuned checkpoint. Provider: Meta. Released 2024-04-18. Access: Open.

Unified ELO 1412 ± 1, rank #1091 of 1392 rated models, from 472 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
CyberSecEval45.27Average Injection Success Rate (self-reported)100
HumanLikeness - Syntax-279.49Humanlike Score (%)100
Open CoT - LSAT Reading Comprehension25.65CoT Gain (%)99.2
AGC-Bench - mops2.05Dataset z-score98.8
LLM Trustworthy - Adversarial67.28Trust Score (%)98
LLM Trustworthy - Ethics93.74Trust Score (%)98
Open CoT Leaderboard14.75Average CoT Gain (%)95.4
AGC-Bench - creatset1.48Dataset z-score95.1
Open LLM Leaderboard - MuSR19.94Score94.7
Open CoT - LogiQA8.15CoT Gain (%)90.5
LLM Trustworthy Leaderboard80.61Average Trust Score (%)90
EuroEval Portuguese NLU - HAREM56.38Named entity recognition Score (%)89.9

Interactive version: theaggregate.ai/model?slug=llama-3-8b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.