Llama 3 8B SFR Iterative DPO R — benchmark results

Provider: Meta. Released 2024-05-09. Access: Open.

Unified ELO 1369 ± 9, rank #1349 of 1776 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open CoT - LSAT Analytical Reasoning5.22CoT Gain (%)68.3
Open CoT - LogiQA 27.7CoT Gain (%)55.7
Open CoT Leaderboard7.43Average CoT Gain (%)51.9
Open CoT - LSAT Reading Comprehension11.52CoT Gain (%)49.6
Open LLM Leaderboard - BBH29.15Score48.7
Open LLM Leaderboard - MATH Level 59.14Score44.7
Open CoT - LogiQA3.67CoT Gain (%)43.1
Open LLM Leaderboard - MMLU-Pro24.14Score42.9
Open LLM Leaderboard - GPQA5.03Score42.5
Open CoT - LSAT Logical Reasoning9.02CoT Gain (%)41.2
Open LLM Leaderboard - IFEval38.16Score37.5
Open LLM Leaderboard - MuSR5.55Score26.9

Interactive version: theaggregate.ai/model?slug=llama-3-8b-sfr-iterative-dpo-r · How the rankings work · Data refreshed daily, snapshot 2026-07-22.