Llama 3 8B ProLong 64k Base — benchmark results

Provider: Meta. Released 2024-07-22. Access: Open.

Unified ELO 1381 ± 17, rank #1309 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard428.13Average Score (%)80.3
Open LLM Leaderboard - MuSR14.62Score79.5
Open LLM Leaderboard - IFEval52.01Score62
Open LLM Leaderboard - MMLU-Pro26.09Score47.5
Open LLM Leaderboard - BBH28.69Score47.4
Open Chinese LLM - CMMLU53.07Accuracy (%)47.2
Open Chinese LLM - WinoGrande62.27Accuracy (%)39.9
Open Chinese LLM - C-Eval Semantic64.76Accuracy (%)38.3
Open LLM Leaderboard - MATH Level 56.5Score35.3
Open Chinese LLM - HellaSwag56.41Accuracy (%)29.7
Open Chinese LLM - GSM8K34.5Accuracy (%)29.1
Open Chinese LLM Leaderboard52.39Average Score (%)26.3

Interactive version: theaggregate.ai/model?slug=llama-3-8b-prolong-64k-base · How the rankings work · Data refreshed daily, snapshot 2026-07-22.