RakutenAI-7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1399 ± 54, rank #1911 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
pfgen-bench - Completion Mode - Fluency0.58Fluency Score51
pfgen-bench - Completion Mode - Score0.47pfgen Score (mean of three)50.8
pfgen-bench - Completion Mode - Helpfulness0.11Helpfulness Score48.6
pfgen-bench - Completion Mode - Truthfulness0.72Truthfulness Score48.6
Open LLM Leaderboard - GPQA28.94Score44
Open LLM Leaderboard - MMLU-Pro28.77Score32.8
Open LLM Leaderboard - BBH43.15Score29.9
Open LLM Leaderboard - MuSR37.38Score25.7
Open LLM Leaderboard - MATH Level 51.96Score13.8
Open LLM Leaderboard - IFEval15.56Score5.7

Interactive version: theaggregate.ai/model?slug=rakutenai-7b · How It Works · Data refreshed daily, snapshot 2026-09-19.