gemma-2-2B-jpn-it: benchmark results
Provider: Google. Access: API.
Unified ELO 1422 ± 52, rank #1736 of 2656 rated models, from 10 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| pfgen-bench - Completion Mode - Truthfulness | 0.81 | Truthfulness Score | 63.9 |
| Open LLM Leaderboard - IFEval | 52.88 | Score | 62.8 |
| pfgen-bench - Completion Mode - Score | 0.46 | pfgen Score (mean of three) | 48.6 |
| Open LLM Leaderboard - GPQA | 28.52 | Score | 40.2 |
| Open LLM Leaderboard - MuSR | 39.64 | Score | 39 |
| pfgen-bench - Completion Mode - Fluency | 0.51 | Fluency Score | 37.4 |
| pfgen-bench - Completion Mode - Helpfulness | 0.07 | Helpfulness Score | 32.9 |
| Open LLM Leaderboard - BBH | 42.26 | Score | 28 |
| Open LLM Leaderboard - MATH Level 5 | 4.76 | Score | 26.9 |
| Open LLM Leaderboard - MMLU-Pro | 25.78 | Score | 26.8 |
Interactive version: theaggregate.ai/model?slug=gemma-2-2b-jpn-it · How It Works · Data refreshed daily, snapshot 2026-09-19.