Llama 2 70B Base — benchmark results

Meta's 70B pretrained base model from the Llama 2 family (July 2023), trained on 2T tokens under the Llama 2 Community License. Provider: Meta. Released 2023-07-18. Access: Open.

Unified ELO 1405 ± 16, rank #1197 of 1776 rated models, from 263 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
TriviaQA87.6Accuracy (%)100
MMLU-by-task - High School Macroeconomics74.1Accuracy (%)99.9
MMLU-by-task - High School Statistics63.43Accuracy (%)99.8
MMLU-by-task - Philosophy78.78Accuracy (%)99.7
MMLU-by-task - Sociology90.05Accuracy (%)99.7
MMLU-by-task - Human Sexuality87.79Accuracy (%)99.6
MMLU-by-task - Nutrition78.1Accuracy (%)99.6
MMLU-by-task - College Biology84.72Accuracy (%)99.5
MMLU-by-task - Electrical Engineering65.52Accuracy (%)99.4
EuroEval Swedish NLU - Swerec80.95Sentiment classification Score (%)99.3
EuroEval Finnish NLU - Scandisent FI93.51Sentiment classification Score (%)99.2
MMLU-by-task - Professional Medicine75Accuracy (%)99.2

Interactive version: theaggregate.ai/model?slug=llama-2-70b-base · How the rankings work · Data refreshed daily, snapshot 2026-07-22.