Llama-3-Instruct-8B-SPPO-Iter1 — benchmark results

Provider: Meta. Released 2024-06-25. Access: Open.

Unified ELO 1381 ± 76, rank #1311 of 1776 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard531.35Average Score (%)90.3
Open LLM Leaderboard - IFEval72.99Score87.1
Open LLM Leaderboard - MMLU-Pro30.12Score60.6
Open LLM Leaderboard - MATH Level 511.48Score52.1
Open LLM Leaderboard - BBH29.49Score49.8
Open LLM Leaderboard - GPQA2.35Score22.1
Open LLM Leaderboard - MuSR2.17Score9.5

Interactive version: theaggregate.ai/model?slug=llama-3-instruct-8b-sppo-iter1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.