Llama 3 8B Instruct — benchmark results

Meta Llama 3 8B instruction-tuned checkpoint. Provider: Meta. Released 2024-04-18. Access: Open.

Unified ELO 1401 ± 10, rank #1218 of 1776 rated models, from 463 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
CyberSecEval45.27Average Injection Success Rate (self-reported)100
HumanLikeness - Syntax-279.49Humanlike Score (%)100
Open CoT - LSAT Reading Comprehension25.65CoT Gain (%)99.2
AGC-Bench - mops2.05Dataset z-score98.8
LLM Trustworthy - Adversarial67.28Trust Score (%)98
LLM Trustworthy - Ethics93.74Trust Score (%)98
Open Japanese LLM - Xlsum JA Bleu JA34.1Score (%)95.7
Open CoT Leaderboard14.75Average CoT Gain (%)95.4
AGC-Bench - creatset1.48Dataset z-score95.1
Open LLM Leaderboard - MuSR19.94Score94.7
Open CoT - LogiQA8.15CoT Gain (%)90.5
LLM Trustworthy Leaderboard80.61Average Trust Score (%)90

Interactive version: theaggregate.ai/model?slug=llama-3-8b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.