youri-7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1340 ± 20, rank #2537 of 2928 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
pfgen-bench - Completion Mode - Fluency0.65Fluency Score63.6
pfgen-bench - Completion Mode - Truthfulness0.8Truthfulness Score63.3
pfgen-bench - Completion Mode - Score0.53pfgen Score (mean of three)61.3
pfgen-bench - Completion Mode - Helpfulness0.15Helpfulness Score56.4
Open LLM Leaderboard v1 - GSM8K8.64Accuracy (%) (5-shot)28.9
Open LLM Leaderboard v1 - WinoGrande71.82Accuracy (%) (5-shot)27.5
Open LLM Leaderboard v1 - HellaSwag74.89Normalized accuracy (%) (10-shot)25.5
Open LLM Leaderboard v1 - ARC Challenge49.06Normalized accuracy (%) (25-shot)23.7
Open LLM Leaderboard v1 - MMLU42.22Accuracy (%) (5-shot)22
Open LLM Leaderboard v1 - TruthfulQA MC236.03MC2 (%) (0-shot)3.1

Interactive version: theaggregate.ai/model?slug=youri-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.