Llama 3 8B Instruct V0.9 — benchmark results

MaziyarPanahi's iterative general-chat fine-tune of Meta Llama 3 8B Instruct, built on top of his v0.8 model. Provider: Meta. Released 2024-05-30. Access: Open.

Unified ELO 1443 ± 19, rank #1035 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval76.3Score91.9
Open Korean LLM Leaderboard508.02Average Score (%)88.3
Open Chinese LLM - TruthfulQA MC57.65Accuracy (%)73.6
Open LLM Leaderboard - MMLU-Pro31.62Score68
Open Chinese LLM - ARC Challenge54.69Accuracy (%)66.2
Open LLM Leaderboard - GPQA7.72Score65.2
Open Chinese LLM Leaderboard58.13Average Score (%)62.3
Open Chinese LLM - GSM8K47.38Accuracy (%)57.9
Open Chinese LLM - C-Eval Semantic71.32Accuracy (%)56.5
Open Chinese LLM - CMMLU54.16Accuracy (%)53.6
Open LLM Leaderboard - MuSR9.85Score48.6
Open Chinese LLM - HellaSwag59.64Accuracy (%)46.7

Interactive version: theaggregate.ai/model?slug=llama-3-8b-instruct-v0-9 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.