Llama 2 7B 32K Instruct: benchmark results

Provider: Meta. Released 2023-07-18. Access: Open.

Unified ELO 1283 ± 13, rank #1494 of 1639 rated models, from 76 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - Abstract Algebra33Accuracy (%)75.6
MMLU-by-task - College Computer Science46Accuracy (%)75.6
MMLU-by-task - Econometrics31.58Accuracy (%)73.2
MMLU-by-task - College Mathematics34Accuracy (%)69.2
MMLU-by-task - High School European History66.06Accuracy (%)66.7
MMLU-by-task - Anatomy47.41Accuracy (%)61.3
MMLU-by-task - High School Physics31.79Accuracy (%)61.3
MMLU-by-task - TruthfulQA MC130.72Accuracy (%)61.3
MMLU-by-task - Sociology66.67Accuracy (%)60.5
MMLU-by-task - Elementary Mathematics30.69Accuracy (%)60.4
MMLU-by-task - Conceptual Physics41.7Accuracy (%)60.3
MMLU-by-task - High School Computer Science49Accuracy (%)59.1

Interactive version: theaggregate.ai/model?slug=llama-2-7b-32k-instruct · How It Works · Data refreshed daily, snapshot 2026-10-09.