Llama 3.1 8B Instruct Orca ORPO: benchmark results
Provider: Meta. Access: Open.
Unified ELO 1221 ± 61, rank #2616 of 2656 rated models, from 11 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - IFEval | 22.73 | Score | 15.9 |
| Open LLM Leaderboard - MuSR | 34.45 | Score | 10.3 |
| Open LLM Leaderboard - MMLU-Pro | 11.68 | Score | 8.2 |
| Open LLM Leaderboard - GPQA | 24.92 | Score | 4.6 |
| Open LLM Leaderboard - MATH Level 5 | 0 | Score | 1.3 |
| Open LLM Leaderboard - BBH | 28.65 | Score | 1.1 |
| Open Portuguese LLM - FaQuAD NLI | 0 | Macro F1 (%) | 1 |
| Open Portuguese LLM - ASSIN2 RTE | 0 | Macro F1 (%) | 0.9 |
| Open Portuguese LLM - OAB Exams | 0 | Accuracy (%) | 0.9 |
| Open Portuguese LLM - ENEM | 0 | Accuracy (%) | 0.8 |
| Open Portuguese LLM - BLUEX | 0 | Accuracy (%) | 0.7 |
Interactive version: theaggregate.ai/model?slug=llama-3-1-8b-instruct-orca-orpo · How It Works · Data refreshed daily, snapshot 2026-09-19.