Tiger-Gemma-9B-v3 — benchmark results
TheDrummer's v3 decensor of Gemma 2 9B, built on the SPPO variant with a new dataset to cut refusals and verbosity. Provider: Other. Released 2024-10-04. Access: Open.
Unified ELO 1519 ± 32, rank #730 of 1776 rated models, from 10 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| UGI - Willingness (W/10) | 8.5 | W/10 Score | 89.2 |
| Open LLM Leaderboard - GPQA | 11.86 | Score | 84.1 |
| Open LLM Leaderboard - IFEval | 68.21 | Score | 80.9 |
| Open LLM Leaderboard - BBH | 38.84 | Score | 78.6 |
| Open LLM Leaderboard - MMLU-Pro | 33.99 | Score | 74.3 |
| Open LLM Leaderboard - MATH Level 5 | 16.24 | Score | 64.2 |
| UGI Leaderboard | 38.75 | UGI Score | 62.7 |
| Open LLM Leaderboard - MuSR | 7.71 | Score | 35.9 |
| UGI - Writing | 28.1 | Writing Score | 31.4 |
| UGI - Natural Intelligence | 16.16 | NatInt Score | 24.7 |
Interactive version: theaggregate.ai/model?slug=tiger-gemma-9b-v3 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.