recoilme-gemma-2-9B-v0.2 — benchmark results
recoilme's mergekit blend of six Gemma 2 9B fine-tunes, an earlier v0.2 iteration of the recoilme-gemma-2 merge series. Provider: Other. Released 2024-09-18. Access: Open.
Unified ELO 1478 ± 15, rank #882 of 1776 rated models, from 130 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Korean LLM Leaderboard | 780.58 | Average Score (%) | 98.2 |
| Open LLM Leaderboard - IFEval | 75.92 | Score | 91.3 |
| Open Arabic LLM - Aratrust Unfairness | 94.55 | Accuracy (%) | 91 |
| Open LLM Leaderboard - MuSR | 17.81 | Score | 89.5 |
| Open Arabic LLM - Aratrust Offensive | 92.75 | Accuracy (%) | 88.2 |
| Open Arabic LLM - Alghafa Multiple Choice Facts Truefalse Balanced Task | 93.33 | Accuracy (%) | 86.7 |
| Open LLM Leaderboard - BBH | 43.56 | Score | 82.8 |
| Open LLM Leaderboard - GPQA | 10.74 | Score | 80.7 |
| Open Arabic LLM - Alghafa Multiple Choice Sentiment Task | 40.99 | Accuracy (%) | 76.5 |
| Open LLM Leaderboard - MMLU-Pro | 35.15 | Score | 75.7 |
| Open Arabic LLM - Aratrust Illegal | 90.57 | Accuracy (%) | 73.9 |
| Open Arabic LLM - Madinah QA Arabic Language (Grammar) | 46.85 | Accuracy (%) | 72.8 |
Interactive version: theaggregate.ai/model?slug=recoilme-gemma-2-9b-v0-2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.