gemma-7B (IT): benchmark results

Provider: Google. Released 2024-02-21. Access: Open.

Unified ELO 1355 ± 1, rank #1257 of 1392 rated models, from 224 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LLM Trustworthy - Stereotype100Trust Score (%)94
Fin-Bias97.6Average Herding Score (with rating) (self-reported)83.3
Open CoT - LogiQA6.55CoT Gain (%)82.1
Open LLM Leaderboard - MuSR12.53Score68.6
LLM Trustworthy - Privacy83.69Trust Score (%)68
LLM Trustworthy - Toxicity75.52Trust Score (%)68
Enkrypt AI - Bias Risk79.59Risk Score65.3
SALAD-Bench54.81Average Safety Score (%)60.6
SALAD-Bench Base94.08Safety Score (%)60.6
LLM Trustworthy - Fairness93.88Trust Score (%)60
InfiBench40.68Score (%)58.1
LLM Trustworthy Leaderboard66.87Average Trust Score (%)56

Interactive version: theaggregate.ai/model?slug=gemma-7b-it · How It Works · Data refreshed daily, snapshot 2026-09-05.