Llama 3 8B Instruct V0.10 — benchmark results

MaziyarPanahi's iterative general-chat fine-tune of Meta Llama 3 8B Instruct, built on top of his v0.9 model. Provider: Meta. Released 2024-06-04. Access: Open.

Unified ELO 1444 ± 19, rank #1031 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval76.67Score92.4
Open Korean LLM Leaderboard502.41Average Score (%)87.7
Open Chinese LLM - TruthfulQA MC58.61Accuracy (%)77.7
Open LLM Leaderboard - MMLU-Pro31.8Score68.9
Open Chinese LLM - ARC Challenge55.03Accuracy (%)67.1
Open LLM Leaderboard - GPQA7.83Score66.2
Open Chinese LLM Leaderboard58.33Average Score (%)62.9
Open Chinese LLM - GSM8K47.38Accuracy (%)57.9
Open LLM Leaderboard - MuSR10.81Score55
Open Chinese LLM - C-Eval Semantic70.57Accuracy (%)53.1
Open Chinese LLM - CMMLU53.86Accuracy (%)52.8
Open Chinese LLM - HellaSwag60.32Accuracy (%)51

Interactive version: theaggregate.ai/model?slug=llama-3-8b-instruct-v0-10 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.