gemma-2-2B-jpn-it: benchmark results

Provider: Google. Access: API.

Unified ELO 1422 ± 52, rank #1736 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
pfgen-bench - Completion Mode - Truthfulness0.81Truthfulness Score63.9
Open LLM Leaderboard - IFEval52.88Score62.8
pfgen-bench - Completion Mode - Score0.46pfgen Score (mean of three)48.6
Open LLM Leaderboard - GPQA28.52Score40.2
Open LLM Leaderboard - MuSR39.64Score39
pfgen-bench - Completion Mode - Fluency0.51Fluency Score37.4
pfgen-bench - Completion Mode - Helpfulness0.07Helpfulness Score32.9
Open LLM Leaderboard - BBH42.26Score28
Open LLM Leaderboard - MATH Level 54.76Score26.9
Open LLM Leaderboard - MMLU-Pro25.78Score26.8

Interactive version: theaggregate.ai/model?slug=gemma-2-2b-jpn-it · How It Works · Data refreshed daily, snapshot 2026-09-19.