Llama 2 13B Chat — benchmark results

Provider: Meta. Released 2023-07-18. Access: Open.

Unified ELO 1173 ± 50, rank #1715 of 1776 rated models, from 30 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Big-Bench Hard58.2Average (%)64.6
European LLM Leaderboard - FLORES20011.71Average FLORES200 Score58.3
European LLM Leaderboard - FLORES200 Target11.71FLORES200 Target Score58.3
European LLM Leaderboard - FLORES200 Source11.71FLORES200 Source Score57.8
FastEval40.94Total Score43.8
GSM8K36.9Accuracy (%)41.5
BenchBench38.68Aggregate Score (%)38.2
InfiBench32.29Score (%)37.1
EconLogicQA0.15Accuracy32.4
European LLM Leaderboard - Zero-Shot Accuracy40Average Accuracy (%)26.8
CyberBench (NLP)49.2Avg Score (%)25
European LLM Leaderboard - Accuracy40.67Average Accuracy (%)23.5

Interactive version: theaggregate.ai/model?slug=llama-2-13b-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.