Llama 3.1 405B — benchmark results

Meta's largest open-weights Llama 3.1 model, a 405B dense frontier-class flagship with a 128K context (July 2024). Provider: Meta. Released 2024-07-23. Access: Open.

Unified ELO 1591 ± 12, rank #500 of 1776 rated models, from 168 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
CRMArena - MTA86.9MTA Score (%)100
CRMArena - NCR81.5NCR Score (%)100
EuroEval Dutch78.43Average Score (%)100
EuroEval Dutch NLU80.98NLU Average Score (%)100
EuroEval English79.72Average Score (%)100
EuroEval Norwegian NLU - Norquad79.66Reading comprehension Score (%)99.7
EuroEval French NLU - FQuAD77.36Reading comprehension Score (%)99.5
EuroEval Finnish NLU70.61NLU Average Score (%)99.2
EuroEval Norwegian NLU71.97NLU Average Score (%)99
EuroEval Spanish NLU - MLQA ES70.79Reading comprehension Score (%)99
EuroEval German NLU - Germanquad69.43Reading comprehension Score (%)98.8
WinoGrande89.2Accuracy (%)98.8

Interactive version: theaggregate.ai/model?slug=llama-3-1-405b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.