gemma-7B (IT) — benchmark results

Provider: Google. Released 2024-02-21. Access: Open.

Unified ELO 1273 ± 17, rank #1584 of 1776 rated models, from 207 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Japanese LLM - Wikicorpus J TO E Bleu EN18.97Score (%)96.6
Open Japanese LLM - Wikicorpus E TO J Bleu JA36.99Score (%)95.4
Open Japanese LLM - ALT E TO J Bleu JA18.17Score (%)94.2
LLM Trustworthy - Stereotype100Trust Score (%)94
Fin-Bias97.6Average Herding Score (with rating) (self-reported)83.3
Open CoT - LogiQA6.55CoT Gain (%)82.1
Open LLM Leaderboard - MuSR12.53Score68.6
LLM Trustworthy - Privacy83.69Trust Score (%)68
LLM Trustworthy - Toxicity75.52Trust Score (%)68
OpenEval - BBQ63.46Exact Match (%)63.8
OpenEval - GPQA CoT27.58CoT Correctness (%)61.9
SALAD-Bench54.81Average Safety Score (%)60.6

Interactive version: theaggregate.ai/model?slug=gemma-7b-it · How the rankings work · Data refreshed daily, snapshot 2026-07-22.