Llama 3.1 8B Instruct Orca ORPO: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1221 ± 61, rank #2616 of 2656 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval22.73Score15.9
Open LLM Leaderboard - MuSR34.45Score10.3
Open LLM Leaderboard - MMLU-Pro11.68Score8.2
Open LLM Leaderboard - GPQA24.92Score4.6
Open LLM Leaderboard - MATH Level 50Score1.3
Open LLM Leaderboard - BBH28.65Score1.1
Open Portuguese LLM - FaQuAD NLI0Macro F1 (%)1
Open Portuguese LLM - ASSIN2 RTE0Macro F1 (%)0.9
Open Portuguese LLM - OAB Exams0Accuracy (%)0.9
Open Portuguese LLM - ENEM0Accuracy (%)0.8
Open Portuguese LLM - BLUEX0Accuracy (%)0.7

Interactive version: theaggregate.ai/model?slug=llama-3-1-8b-instruct-orca-orpo · How It Works · Data refreshed daily, snapshot 2026-09-19.