gemma-2B (IT): benchmark results

Provider: Google. Released 2024-02-21. Access: Open.

Unified ELO 1333 ± 1, rank #1299 of 1392 rated models, from 156 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SALAD-Bench73.12Average Safety Score (%)84.8
SALAD-Bench Attack50.34Safety Score (%)84.8
LLM Trustworthy - Privacy88.77Trust Score (%)80
SALAD-Bench Base95.9Safety Score (%)78.8
LLM Trustworthy - Toxicity77.07Trust Score (%)72
LLM Trustworthy - Ethics75.03Trust Score (%)64
LLM Trustworthy Leaderboard67.18Average Trust Score (%)60
LLM Trustworthy - Fairness93.02Trust Score (%)56
Open CoT - LogiQA4.31CoT Gain (%)54.2
Open CoT - LSAT Analytical Reasoning3.91CoT Gain (%)50.8
Open Japanese LLM - Xlsum JA Rouge125.26Score (%)46.9
Open Japanese LLM - Xlsum JA RougeLsum19.89Score (%)36.8

Interactive version: theaggregate.ai/model?slug=gemma-2b-it · How It Works · Data refreshed daily, snapshot 2026-09-05.