SELM-Llama-3-8B-Instruct-iter-3 — benchmark results
Provider: Other. Released 2024-08-06. Access: Open.
Unified ELO 1355 ± 66, rank #1397 of 1776 rated models, from 7 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - IFEval | 69.03 | Score | 81.9 |
| Open LLM Leaderboard - MMLU-Pro | 30.92 | Score | 64.5 |
| Open LLM Leaderboard - BBH | 29.08 | Score | 48.6 |
| Open LLM Leaderboard - MATH Level 5 | 8.61 | Score | 43 |
| WildBench | 35.26 | WB Score Task-Macro | 41.9 |
| Open LLM Leaderboard - MuSR | 5.5 | Score | 26.7 |
| Open LLM Leaderboard - GPQA | 1.12 | Score | 10.5 |
Interactive version: theaggregate.ai/model?slug=selm-llama-3-8b-instruct-iter-3 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.