SELM-Llama-3-8B-Instruct-iter-3 — benchmark results

Provider: Other. Released 2024-08-06. Access: Open.

Unified ELO 1355 ± 66, rank #1397 of 1776 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval69.03Score81.9
Open LLM Leaderboard - MMLU-Pro30.92Score64.5
Open LLM Leaderboard - BBH29.08Score48.6
Open LLM Leaderboard - MATH Level 58.61Score43
WildBench35.26WB Score Task-Macro41.9
Open LLM Leaderboard - MuSR5.5Score26.7
Open LLM Leaderboard - GPQA1.12Score10.5

Interactive version: theaggregate.ai/model?slug=selm-llama-3-8b-instruct-iter-3 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.