Llama 3 70B — benchmark results

Meta's 70B pretrained base model from the original Llama 3 release, with an 8K context - the foundation for its instruct variant (April 2024). Provider: Meta. Released 2024-04-18. Access: Open.

Unified ELO 1504 ± 15, rank #783 of 1776 rated models, from 164 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
CyberSecEval-344.14Score (%)100
IFEval Leaderboard83.31Final Score100
Open Japanese LLM - MR94.8Score (%)99.2
HELM NarrativeQA79.82F1 (%)98.9
Open LLM Leaderboard - GPQA19.69Score98.9
EuroEval Finnish NLU - Tydiqa FI77.11Reading comprehension Score (%)98.8
EuroEval Finnish NLU69.49NLU Average Score (%)98.4
EuroEval French NLU - FQuAD76.09Reading comprehension Score (%)97.6
EuroEval Portuguese NLU - MultiWikiQA PT78.57Reading comprehension Score (%)97.5
Open Japanese LLM - Wikicorpus E TO J Bert Score JA F185.84Score (%)96.4
EuroEval Italian NLU - MultiNERD IT84.06Named entity recognition Score (%)96.3
Open Japanese LLM - Wikicorpus E TO J Comet Wmt2285.54Score (%)95.9

Interactive version: theaggregate.ai/model?slug=llama-3-70b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.