Llama 3 8B: benchmark results
Provider: Meta. Released 2024-04-18. Access: Open.
Unified ELO 1417 ± 1, rank #1081 of 1392 rated models, from 243 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| EuroEval Portuguese NLU - MultiWikiQA PT | 77.31 | Reading comprehension Score (%) | 93.8 |
| EuroEval Finnish NLU - Tydiqa FI | 74.51 | Reading comprehension Score (%) | 92.5 |
| EuroEval Dutch NLU - DBRD | 91.87 | Sentiment classification Score (%) | 90.2 |
| EuroEval Finnish NLU - Scandisent FI | 92.2 | Sentiment classification Score (%) | 88.3 |
| EuroEval French NLU - FQuAD | 72.66 | Reading comprehension Score (%) | 87.4 |
| EuroEval Spanish NLU - MLQA ES | 65.7 | Reading comprehension Score (%) | 85.8 |
| Open Medical LLM - MMLU Medical Genetics | 83 | Accuracy (%) | 85.8 |
| Open Medical LLM - MedMCQA | 57.47 | Accuracy (%) | 83.8 |
| Open Medical LLM - MMLU Anatomy | 68.89 | Accuracy (%) | 83.5 |
| IFEval Leaderboard | 78.84 | Final Score | 80 |
| EuroEval Portuguese NLU - SST-2 PT | 82.5 | Sentiment classification Score (%) | 79.3 |
| European LLM Leaderboard - FLORES200 Target | 15.84 | FLORES200 Target Score | 79.2 |
Interactive version: theaggregate.ai/model?slug=llama-3-8b · How It Works · Data refreshed daily, snapshot 2026-09-05.