Llama 2 7B 32K — benchmark results

Provider: Meta. Released 2023-07-18. Access: Open.

Unified ELO 1201 ± 15, rank #1691 of 1776 rated models, from 70 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - College Mathematics34Accuracy (%)69.2
MMLU-by-task - College Computer Science44Accuracy (%)67.5
MMLU-by-task - Global Facts35Accuracy (%)64.1
MMLU-by-task - College Chemistry37Accuracy (%)62.3
MMLU-by-task - Elementary Mathematics30.42Accuracy (%)59.1
MMLU-by-task - Medical Genetics54Accuracy (%)58.2
MMLU-by-task - Econometrics28.95Accuracy (%)55.1
MMLU-by-task - High School Statistics39.81Accuracy (%)54.6
MMLU-by-task - Astronomy44.74Accuracy (%)52.5
MMLU-by-task - High School US History59.31Accuracy (%)51.7
MMLU-by-task - High School World History64.56Accuracy (%)51.3
MMLU-by-task - High School Physics30.46Accuracy (%)50.8

Interactive version: theaggregate.ai/model?slug=llama-2-7b-32k · How the rankings work · Data refreshed daily, snapshot 2026-07-22.