Tiger-Gemma-9B-v3 — benchmark results

TheDrummer's v3 decensor of Gemma 2 9B, built on the SPPO variant with a new dataset to cut refusals and verbosity. Provider: Other. Released 2024-10-04. Access: Open.

Unified ELO 1519 ± 32, rank #730 of 1776 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI - Willingness (W/10)8.5W/10 Score89.2
Open LLM Leaderboard - GPQA11.86Score84.1
Open LLM Leaderboard - IFEval68.21Score80.9
Open LLM Leaderboard - BBH38.84Score78.6
Open LLM Leaderboard - MMLU-Pro33.99Score74.3
Open LLM Leaderboard - MATH Level 516.24Score64.2
UGI Leaderboard38.75UGI Score62.7
Open LLM Leaderboard - MuSR7.71Score35.9
UGI - Writing28.1Writing Score31.4
UGI - Natural Intelligence16.16NatInt Score24.7

Interactive version: theaggregate.ai/model?slug=tiger-gemma-9b-v3 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.