Llama-3-Instruct-8B-IPO: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1516 ± 17, rank #999 of 2656 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-EQ-Bench45.06EQ-Bench score93.9
Open Korean LLM - Ko-IFEval48.79Strict accuracy, prompt/instruction mean (%)92.7
Open Korean LLM Leaderboard43.16Average Score (%)87.5
Open Ko-LLM Leaderboard43.16Average (%)87.3
Open Korean LLM - Ko-GSM8K (flexible extract)53.68Exact match, flexible extract (%)87.3
Open Korean LLM - Ko-GPQA-Diamond25.76Normalized accuracy (%)81.3
Open Portuguese LLM - ASSIN2 RTE91.95Macro F1 (%)72.8
Open Portuguese LLM - ENEM68.51Accuracy (%)70.3
Open Portuguese LLM - OAB Exams48.34Accuracy (%)69.4
Open Portuguese LLM - BLUEX55.49Accuracy (%)63.4
Open Korean LLM - KorNAT-CKA26.12Normalized accuracy (%)62.3
Open Korean LLM - Ko-Winogrande61.09Accuracy (%)59.7

Interactive version: theaggregate.ai/model?slug=llama-3-instruct-8b-ipo · How It Works · Data refreshed daily, snapshot 2026-09-19.