T3Q-LLM-sft1.0-dpo1.0: benchmark results

Provider: Other. Access: Open.

Unified ELO 1550 ± 18, rank #841 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - KorNAT-CKA37.65Normalized accuracy (%)97.3
Open Korean LLM - Ko-EQ-Bench55.31EQ-Bench score96.5
Open Korean LLM - Ko-GPQA-Diamond27.78Normalized accuracy (%)95
Open Korean LLM Leaderboard46.07Average Score (%)92.6
Open Ko-LLM Leaderboard46.07Average (%)92.5
Open Korean LLM - Ko-Winogrande68.11Accuracy (%)92.5
Open Korean LLM - KorNAT-Harmless67.97Normalized accuracy (%)91.2
Open Korean LLM - KorNAT-Helpful50.42Normalized accuracy (%)85.6
Open Korean LLM - Ko-GSM8K (flexible extract)51.18Exact match, flexible extract (%)84.7
Open Korean LLM - Ko-IFEval37.02Strict accuracy, prompt/instruction mean (%)77.3

Interactive version: theaggregate.ai/model?slug=t3q-llm-sft1-0-dpo1-0 · How It Works · Data refreshed daily, snapshot 2026-09-19.