recoilme-gemma-2-9B-v0.2 — benchmark results

recoilme's mergekit blend of six Gemma 2 9B fine-tunes, an earlier v0.2 iteration of the recoilme-gemma-2 merge series. Provider: Other. Released 2024-09-18. Access: Open.

Unified ELO 1478 ± 15, rank #882 of 1776 rated models, from 130 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard780.58Average Score (%)98.2
Open LLM Leaderboard - IFEval75.92Score91.3
Open Arabic LLM - Aratrust Unfairness94.55Accuracy (%)91
Open LLM Leaderboard - MuSR17.81Score89.5
Open Arabic LLM - Aratrust Offensive92.75Accuracy (%)88.2
Open Arabic LLM - Alghafa Multiple Choice Facts Truefalse Balanced Task93.33Accuracy (%)86.7
Open LLM Leaderboard - BBH43.56Score82.8
Open LLM Leaderboard - GPQA10.74Score80.7
Open Arabic LLM - Alghafa Multiple Choice Sentiment Task40.99Accuracy (%)76.5
Open LLM Leaderboard - MMLU-Pro35.15Score75.7
Open Arabic LLM - Aratrust Illegal90.57Accuracy (%)73.9
Open Arabic LLM - Madinah QA Arabic Language (Grammar)46.85Accuracy (%)72.8

Interactive version: theaggregate.ai/model?slug=recoilme-gemma-2-9b-v0-2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.