ELYZA-japanese-Llama-2-7B-fast-instruct: benchmark results

Provider: Other. Access: Open.

Unified ELO 1360 ± 20, rank #2414 of 2928 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
pfgen-bench - Completion Mode - Helpfulness0.08Helpfulness Score38.2
pfgen-bench - Completion Mode - Truthfulness0.64Truthfulness Score36.9
pfgen-bench - Completion Mode - Score0.41pfgen Score (mean of three)36.4
pfgen-bench - Completion Mode - Fluency0.5Fluency Score35
Open LLM Leaderboard v1 - HellaSwag77.55Normalized accuracy (%) (10-shot)31.1
Open LLM Leaderboard v1 - ARC Challenge53.75Normalized accuracy (%) (25-shot)30.2
Open LLM Leaderboard v1 - WinoGrande71.59Accuracy (%) (5-shot)26.9
Open LLM Leaderboard v1 - MMLU46.85Accuracy (%) (5-shot)25.7
Open LLM Leaderboard v1 - GSM8K6.29Accuracy (%) (5-shot)25.4
pfgen-bench - QA Mode - Helpfulness0.06Helpfulness Score23
pfgen-bench - QA Mode - Score0.36pfgen Score (mean of three)21.2
pfgen-bench - QA Mode - Fluency0.44Fluency Score20

Interactive version: theaggregate.ai/model?slug=elyza-japanese-llama-2-7b-fast-instruct · How It Works · Data refreshed daily, snapshot 2026-09-23.