gemma-2B (IT): benchmark results
Provider: Google. Released 2024-02-21. Access: Open.
Unified ELO 1333 ± 1, rank #1299 of 1392 rated models, from 156 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| SALAD-Bench | 73.12 | Average Safety Score (%) | 84.8 |
| SALAD-Bench Attack | 50.34 | Safety Score (%) | 84.8 |
| LLM Trustworthy - Privacy | 88.77 | Trust Score (%) | 80 |
| SALAD-Bench Base | 95.9 | Safety Score (%) | 78.8 |
| LLM Trustworthy - Toxicity | 77.07 | Trust Score (%) | 72 |
| LLM Trustworthy - Ethics | 75.03 | Trust Score (%) | 64 |
| LLM Trustworthy Leaderboard | 67.18 | Average Trust Score (%) | 60 |
| LLM Trustworthy - Fairness | 93.02 | Trust Score (%) | 56 |
| Open CoT - LogiQA | 4.31 | CoT Gain (%) | 54.2 |
| Open CoT - LSAT Analytical Reasoning | 3.91 | CoT Gain (%) | 50.8 |
| Open Japanese LLM - Xlsum JA Rouge1 | 25.26 | Score (%) | 46.9 |
| Open Japanese LLM - Xlsum JA RougeLsum | 19.89 | Score (%) | 36.8 |
Interactive version: theaggregate.ai/model?slug=gemma-2b-it · How It Works · Data refreshed daily, snapshot 2026-09-05.