T3Q-LLM1-sft1.0-dpo1.0: benchmark results

Provider: Other. Released 2024-05-27. Access: Open.

Unified ELO 1563 ± 19, rank #783 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-GPQA-Diamond31.31Normalized accuracy (%)99.9
Open Korean LLM - KorNAT-Harmless74.24Normalized accuracy (%)97
Open Korean LLM - KorNAT-Helpful56.75Normalized accuracy (%)96.5
Open Korean LLM - KorNAT-CKA34.72Normalized accuracy (%)94.4
Open Korean LLM - Ko-EQ-Bench44.67EQ-Bench score93.8
Open Korean LLM Leaderboard46.4Average Score (%)93.3
Open Ko-LLM Leaderboard46.4Average (%)93.2
Open Korean LLM - Ko-GSM8K (flexible extract)58.91Exact match, flexible extract (%)93
Open Korean LLM - Ko-Winogrande68.27Accuracy (%)92.8
Open Korean LLM - Ko-IFEval44.45Strict accuracy, prompt/instruction mean (%)88.9

Interactive version: theaggregate.ai/model?slug=t3q-llm1-sft1-0-dpo1-0 · How It Works · Data refreshed daily, snapshot 2026-09-19.