Llama 3.1 8B ShiningValiant2 — benchmark results

Valiant Labs' science-and-engineering fine-tune of Llama 3.1 8B Instruct, emphasizing technical knowledge and structured reasoning. Provider: Meta. Released 2024-08-06. Access: Open.

Unified ELO 1415 ± 50, rank #1156 of 1776 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval64.96Score77.2
Open LLM Leaderboard - GPQA8.05Score67.9
Open LLM Leaderboard - MuSR10.79Score54.9
Open Korean LLM Leaderboard125.26Average Score (%)53.3
Open LLM Leaderboard - MMLU-Pro26.46Score48.3
Open LLM Leaderboard - BBH26.35Score41.1
Open LLM Leaderboard - MATH Level 55.66Score31.3

Interactive version: theaggregate.ai/model?slug=llama-3-1-8b-shiningvaliant2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.