llama-3-youko-8B: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1440 ± 20, rank #1814 of 2928 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
pfgen-bench - Completion Mode - Fluency0.67Fluency Score66.1
pfgen-bench - Completion Mode - Truthfulness0.81Truthfulness Score66.1
pfgen-bench - Completion Mode - Score0.56pfgen Score (mean of three)64.5
pfgen-bench - Completion Mode - Helpfulness0.19Helpfulness Score62.5
Open LLM Leaderboard v1 - GSM8K34.42Accuracy (%) (5-shot)50.3
Open LLM Leaderboard v1 - MMLU60.9Accuracy (%) (5-shot)50.1
Open LLM Leaderboard v1 - HellaSwag79.91Normalized accuracy (%) (10-shot)39.5
Open LLM Leaderboard v1 - WinoGrande74.59Accuracy (%) (5-shot)37.5
Open LLM Leaderboard v1 - ARC Challenge54.44Normalized accuracy (%) (25-shot)31.5
Open LLM Leaderboard v1 - TruthfulQA MC241.05MC2 (%) (0-shot)15.9

Interactive version: theaggregate.ai/model?slug=llama-3-youko-8b · How It Works · Data refreshed daily, snapshot 2026-09-23.