RakutenAI-7B-instruct: benchmark results

Provider: Other. Access: Open.

Unified ELO 1481 ± 50, rank #1274 of 2656 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
pfgen-bench - Completion Mode - Fluency0.6Fluency Score56.9
pfgen-bench - Completion Mode - Score0.49pfgen Score (mean of three)55
pfgen-bench - Completion Mode - Helpfulness0.13Helpfulness Score53
pfgen-bench - Completion Mode - Truthfulness0.75Truthfulness Score52.7
pfgen-bench - QA Mode - Truthfulness0.73Truthfulness Score45.8
pfgen-bench - QA Mode - Score0.45pfgen Score (mean of three)40.6
pfgen-bench - QA Mode - Helpfulness0.11Helpfulness Score38.2
pfgen-bench - QA Mode - Fluency0.53Fluency Score37.6
Enkrypt AI - Bias Risk86.82Risk Score32
Enkrypt AI - Insecure Code Risk64.44Risk Score15.5
Enkrypt AI - Jailbreak Risk19.73Risk Score15.3
Enkrypt AI - Risk Score48.74Risk Score9.8

Interactive version: theaggregate.ai/model?slug=rakutenai-7b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-19.