Llama 2 13B FP16: benchmark results

Provider: Meta. Released 2023-07-18. Access: Open.

Unified ELO 1394 ± 10, rank #2185 of 2928 rated models, from 78 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - High School Physics37.09Accuracy (%)88
MMLU-by-task - Abstract Algebra35Accuracy (%)87.4
MMLU-by-task - College Chemistry44Accuracy (%)86.5
MMLU-by-task - Jurisprudence74.07Accuracy (%)85.8
MMLU-by-task - High School Chemistry44.83Accuracy (%)83.9
MMLU-by-task - Moral Disputes64.74Accuracy (%)83.8
MMLU-by-task - High School Biology67.42Accuracy (%)82.9
MMLU-by-task - Nutrition62.42Accuracy (%)82.7
MMLU-by-task - Computer Security70Accuracy (%)82.6
MMLU-by-task - Formal Logic38.1Accuracy (%)82
MMLU-by-task - College Medicine53.18Accuracy (%)81.9
MMLU-by-task - High School Microeconomics58.4Accuracy (%)81.9

Interactive version: theaggregate.ai/model?slug=llama-2-13b-fp16 · How It Works · Data refreshed daily, snapshot 2026-09-23.