Llama 3.1 8B Fireplace2: benchmark results
Provider: Meta. Released 2024-07-23. Access: Open.
Unified ELO 1442 ± 1, rank #1092 of 1553 rated models, from 7 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - IFEval | 54.83 | Score | 66.2 |
| Open Korean LLM Leaderboard | 37.05 | Average Score (%) | 57.5 |
| Open LLM Leaderboard - GPQA | 5.26 | Score | 44 |
| Open LLM Leaderboard - MATH Level 5 | 8.76 | Score | 43.4 |
| Open LLM Leaderboard - BBH | 24.09 | Score | 36.7 |
| Open LLM Leaderboard - MMLU-Pro | 15.82 | Score | 24.9 |
| Open LLM Leaderboard - MuSR | 4.38 | Score | 21.6 |
Interactive version: theaggregate.ai/model?slug=llama-3-1-8b-fireplace2 · How It Works · Data refreshed daily, snapshot 2026-09-08.