gemma-2-27B-it-abliterated: benchmark results

Provider: Google. Released 2024-08-28. Access: API.

Unified ELO 1659 ± 17, rank #428 of 2656 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Ko-LLM Leaderboard55.5Average (%)99.9
Open Korean LLM - Ko-GSM8K (flexible extract)78.01Exact match, flexible extract (%)99.9
Open Korean LLM - Ko-IFEval72.87Strict accuracy, prompt/instruction mean (%)99.9
Open Korean LLM Leaderboard55.5Average Score (%)99.9
Open Korean LLM - KorNAT-CKA38.75Normalized accuracy (%)98.1
Open Korean LLM - Ko-EQ-Bench57.84EQ-Bench score97.4
Open Korean LLM - Ko-Winogrande69.69Accuracy (%)95.4
Open Portuguese LLM - BLUEX71.07Accuracy (%)92.5
Open Korean LLM - Ko-GPQA-Diamond27.27Normalized accuracy (%)92.4
Open Portuguese LLM - ENEM78.59Accuracy (%)92.1
Open Portuguese LLM - OAB Exams57.77Accuracy (%)90.9
Open Korean LLM - KorNAT-Helpful50.52Normalized accuracy (%)86.2

Interactive version: theaggregate.ai/model?slug=gemma-2-27b-it-abliterated · How It Works · Data refreshed daily, snapshot 2026-09-19.