T3Q-gemma2-9B-it-Ko-safe: benchmark results

Provider: Other. Access: Open.

Unified ELO 1534 ± 17, rank #922 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-EQ-Bench51.01EQ-Bench score95.3
Open Korean LLM - Ko-GSM8K (flexible extract)60.35Exact match, flexible extract (%)94
Open Korean LLM - Ko-IFEval47.58Strict accuracy, prompt/instruction mean (%)92.1
Open Ko-LLM Leaderboard45.34Average (%)91.7
Open Korean LLM Leaderboard45.34Average Score (%)91.7
Open Korean LLM - KorNAT-CKA29.96Normalized accuracy (%)81.6
Open Korean LLM - Ko-GPQA-Diamond23.74Normalized accuracy (%)55.6
Open Korean LLM - Ko-Winogrande60.22Accuracy (%)52.3
Open Korean LLM - KorNAT-Harmless62.54Normalized accuracy (%)45.5
Open Korean LLM - KorNAT-Helpful41.33Normalized accuracy (%)11.3

Interactive version: theaggregate.ai/model?slug=t3q-gemma2-9b-it-ko-safe · How It Works · Data refreshed daily, snapshot 2026-09-19.