Llama-3-Smaug-8B: benchmark results
Provider: Meta. Released 2024-05-01. Access: Open.
Unified ELO 1450 ± 1, rank #943 of 1392 rated models, from 26 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Korean LLM Leaderboard | 41.68 | Average Score (%) | 80.4 |
| Open Medical LLM - MMLU College Medicine | 64.74 | Accuracy (%) | 64.2 |
| Open Medical LLM - MedMCQA | 56.08 | Accuracy (%) | 64.2 |
| Open Medical LLM - MedQA (USMLE) | 59.31 | Accuracy (%) | 63.1 |
| Open Medical LLM - MMLU Medical Genetics | 78 | Accuracy (%) | 59.1 |
| Open Medical LLM - MMLU Anatomy | 62.22 | Accuracy (%) | 58.8 |
| Open LLM Leaderboard - IFEval | 48.67 | Score | 56.9 |
| Open Medical LLM - MMLU College Biology | 75 | Accuracy (%) | 56 |
| Open Medical LLM | 66.88 | Average Accuracy (%) | 52.8 |
| Open Chinese LLM - WinoGrande | 62.98 | Accuracy (%) | 51.2 |
| Open Medical LLM - MMLU Clinical Knowledge | 70.94 | Accuracy (%) | 50.3 |
| Open Chinese LLM - TruthfulQA MC | 53.12 | Accuracy (%) | 45.7 |
Interactive version: theaggregate.ai/model?slug=llama-3-smaug-8b · How It Works · Data refreshed daily, snapshot 2026-09-05.