Tess-v2.5-Gemma-2-27B-alpha: benchmark results

Provider: Other. Access: Open.

Unified ELO 1572 ± 17, rank #746 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard49.08Average Score (%)96.5
Open Ko-LLM Leaderboard49.08Average (%)96.4
Open Korean LLM - Ko-IFEval54.38Strict accuracy, prompt/instruction mean (%)96.1
Open Korean LLM - Ko-GSM8K (flexible extract)61.79Exact match, flexible extract (%)95.2
Open Korean LLM - Ko-EQ-Bench48.19EQ-Bench score94.7
Open Korean LLM - KorNAT-CKA33.44Normalized accuracy (%)91.9
Open Korean LLM - KorNAT-Harmless66.07Normalized accuracy (%)84
Open Korean LLM - KorNAT-Helpful49.85Normalized accuracy (%)82.1
Open Korean LLM - Ko-GPQA-Diamond25.76Normalized accuracy (%)81.3
Open Korean LLM - Ko-Winogrande64.88Accuracy (%)81.2

Interactive version: theaggregate.ai/model?slug=tess-v2-5-gemma-2-27b-alpha · How It Works · Data refreshed daily, snapshot 2026-09-19.