Llama 3.1 8B Ultra Instruct — benchmark results
Dampfinchen's DARE-TIES merge of four Llama 3.1 8B fine-tunes, including Stheno v3.4 and Storm, for general instruction following. Provider: Meta. Released 2024-08-26. Access: Open.
Unified ELO 1504 ± 48, rank #786 of 1776 rated models, from 7 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - IFEval | 80.81 | Score | 98.2 |
| Open Korean LLM Leaderboard | 536.64 | Average Score (%) | 91 |
| Open LLM Leaderboard - MATH Level 5 | 22.05 | Score | 74.8 |
| Open LLM Leaderboard - MMLU-Pro | 31.4 | Score | 66.9 |
| Open LLM Leaderboard - BBH | 32.49 | Score | 61.6 |
| Open LLM Leaderboard - GPQA | 5.59 | Score | 46.9 |
| Open LLM Leaderboard - MuSR | 8.61 | Score | 41.6 |
Interactive version: theaggregate.ai/model?slug=llama-3-1-8b-ultra-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.