Llama-3-Smaug-8B: benchmark results

Provider: Meta. Released 2024-05-01. Access: Open.

Unified ELO 1450 ± 1, rank #943 of 1392 rated models, from 26 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard41.68Average Score (%)80.4
Open Medical LLM - MMLU College Medicine64.74Accuracy (%)64.2
Open Medical LLM - MedMCQA56.08Accuracy (%)64.2
Open Medical LLM - MedQA (USMLE)59.31Accuracy (%)63.1
Open Medical LLM - MMLU Medical Genetics78Accuracy (%)59.1
Open Medical LLM - MMLU Anatomy62.22Accuracy (%)58.8
Open LLM Leaderboard - IFEval48.67Score56.9
Open Medical LLM - MMLU College Biology75Accuracy (%)56
Open Medical LLM66.88Average Accuracy (%)52.8
Open Chinese LLM - WinoGrande62.98Accuracy (%)51.2
Open Medical LLM - MMLU Clinical Knowledge70.94Accuracy (%)50.3
Open Chinese LLM - TruthfulQA MC53.12Accuracy (%)45.7

Interactive version: theaggregate.ai/model?slug=llama-3-smaug-8b · How It Works · Data refreshed daily, snapshot 2026-09-05.