Llama 3 8B Orpo V0.1 — benchmark results

Provider: Meta. Released 2024-04-26. Access: Open.

Unified ELO 1315 ± 23, rank #1503 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - WinoGrande64.33Accuracy (%)66.3
Open Chinese LLM - CMMLU53.37Accuracy (%)49.6
Open Chinese LLM - HellaSwag58.12Accuracy (%)36.6
Open Chinese LLM - C-Eval Semantic62.64Accuracy (%)31.5
Open Chinese LLM - TruthfulQA MC51.75Accuracy (%)31.5
Open Korean LLM Leaderboard33.54Average Score (%)30.8
Open LLM Leaderboard - MATH Level 55.21Score29.1
Open LLM Leaderboard - IFEval30Score27.4
Open Chinese LLM - GSM8K31.69Accuracy (%)26.1
Open Chinese LLM Leaderboard52.35Average Score (%)25.8
Open LLM Leaderboard - MMLU-Pro14.42Score23.6
Open LLM Leaderboard - BBH13.77Score22.4

Interactive version: theaggregate.ai/model?slug=llama-3-8b-orpo-v0-1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.