japanese-stablelm-base-gamma-7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1402 ± 20, rank #2132 of 2928 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
pfgen-bench - Completion Mode - Fluency0.69Fluency Score71.6
pfgen-bench - Completion Mode - Score0.58pfgen Score (mean of three)70
pfgen-bench - Completion Mode - Helpfulness0.23Helpfulness Score68.4
pfgen-bench - Completion Mode - Truthfulness0.82Truthfulness Score68.2
Open LLM Leaderboard v1 - GSM8K17.82Accuracy (%) (5-shot)39.3
Open LLM Leaderboard v1 - MMLU54.75Accuracy (%) (5-shot)34.7
Open LLM Leaderboard v1 - WinoGrande73.95Accuracy (%) (5-shot)34.2
Open LLM Leaderboard v1 - HellaSwag77.47Normalized accuracy (%) (10-shot)31
Open LLM Leaderboard v1 - ARC Challenge50.34Normalized accuracy (%) (25-shot)24.7
Open LLM Leaderboard v1 - TruthfulQA MC241.2MC2 (%) (0-shot)16.3

Interactive version: theaggregate.ai/model?slug=japanese-stablelm-base-gamma-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.