Llama-3-Instruct-8B-IPO-v0.2: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1451 ± 17, rank #1516 of 2656 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - KorNAT-Helpful51.65Normalized accuracy (%)91.5
Open Korean LLM - Ko-GSM8K (flexible extract)57.01Exact match, flexible extract (%)91.3
Open Korean LLM - Ko-GPQA-Diamond26.77Normalized accuracy (%)88.9
Open Korean LLM - Ko-IFEval44.37Strict accuracy, prompt/instruction mean (%)88.8
Open Portuguese LLM - OAB Exams49.48Accuracy (%)72.9
Open Portuguese LLM - ENEM69Accuracy (%)71.8
Open Portuguese LLM - BLUEX57.3Accuracy (%)69.4
Open Korean LLM - KorNAT-CKA26.17Normalized accuracy (%)62.5
Open Ko-LLM Leaderboard37.08Average (%)60.7
Open Korean LLM Leaderboard37.08Average Score (%)60.7
Open Korean LLM - KorNAT-Harmless63.32Normalized accuracy (%)60.3
Open Korean LLM - Ko-Winogrande60.62Accuracy (%)56

Interactive version: theaggregate.ai/model?slug=llama-3-instruct-8b-ipo-v0-2 · How It Works · Data refreshed daily, snapshot 2026-09-19.