Llama-3-Instruct-8B-RRHF-v0.2: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1431 ± 58, rank #1655 of 2656 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval71.25Score84.6
Open Portuguese LLM - ASSIN2 RTE92.44Macro F1 (%)79
Open Portuguese LLM - BLUEX58.14Accuracy (%)72.2
Open Portuguese LLM - OAB Exams49.16Accuracy (%)71.6
Open Portuguese LLM - ENEM68.09Accuracy (%)68.7
Open Portuguese LLM - FaQuAD NLI67.78Macro F1 (%)55.2
Open LLM Leaderboard - MMLU-Pro34.82Score50.9
Open LLM Leaderboard - BBH49.84Score47.8
Open LLM Leaderboard - MATH Level 58.76Score43.4
Open LLM Leaderboard - MuSR37.38Score25.7
Open LLM Leaderboard - GPQA26.01Score13.2

Interactive version: theaggregate.ai/model?slug=llama-3-instruct-8b-rrhf-v0-2 · How It Works · Data refreshed daily, snapshot 2026-09-19.