gemma-2B (IT) — benchmark results
Provider: Google. Released 2024-02-21. Access: Open.
Unified ELO 1239 ± 21, rank #1642 of 1776 rated models, from 144 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Japanese LLM - Wikicorpus E TO J Bleu JA | 40.13 | Score (%) | 95.9 |
| Open Japanese LLM - Wikicorpus J TO E Bleu EN | 15.19 | Score (%) | 95.9 |
| Open Japanese LLM - ALT E TO J Bleu JA | 25.68 | Score (%) | 95.4 |
| Open Japanese LLM - ALT J TO E Bleu EN | 18.83 | Score (%) | 90.1 |
| SALAD-Bench | 73.12 | Average Safety Score (%) | 84.8 |
| SALAD-Bench Attack | 50.34 | Safety Score (%) | 84.8 |
| LLM Trustworthy - Privacy | 88.77 | Trust Score (%) | 80 |
| SALAD-Bench Base | 95.9 | Safety Score (%) | 78.8 |
| LLM Trustworthy - Toxicity | 77.07 | Trust Score (%) | 72 |
| LLM Trustworthy - Ethics | 75.03 | Trust Score (%) | 64 |
| LLM Trustworthy Leaderboard | 67.18 | Average Trust Score (%) | 60 |
| LLM Trustworthy - Fairness | 93.02 | Trust Score (%) | 56 |
Interactive version: theaggregate.ai/model?slug=gemma-2b-it · How the rankings work · Data refreshed daily, snapshot 2026-07-22.