Llama-3-Swallow-8B-Instruct-v0.1 — benchmark results

Provider: Meta. Released 2024-06-26. Access: Open.

Unified ELO 1398 ± 12, rank #1238 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard440.3Average Score (%)81.5
Open LLM Leaderboard - MuSR13.8Score75.9
Open LLM Leaderboard - IFEval55.08Score66.5
Open LLM Leaderboard - BBH29.27Score49.2
Open Chinese LLM - TruthfulQA MC53.34Accuracy (%)47.5
Open LLM Leaderboard - GPQA5.26Score44
Open LLM Leaderboard - MMLU-Pro23.2Score39.5
Open LLM Leaderboard - MATH Level 57.48Score39.1
Open Chinese LLM - CMMLU50.24Accuracy (%)35.3
Open Chinese LLM - GSM8K37.98Accuracy (%)35.3
Open Chinese LLM - C-Eval Semantic61.95Accuracy (%)26.7
Open Chinese LLM Leaderboard51.92Average Score (%)24.6

Interactive version: theaggregate.ai/model?slug=llama-3-swallow-8b-instruct-v0-1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.