T3Q-LLM1-CV-v2.0: benchmark results

Provider: Other. Access: Open.

Unified ELO 1542 ± 18, rank #878 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - KorNAT-Helpful60.05Normalized accuracy (%)97.7
Open Korean LLM - KorNAT-Harmless76.57Normalized accuracy (%)97.4
Open Korean LLM - Ko-EQ-Bench52.71EQ-Bench score96.1
Open Korean LLM Leaderboard44.78Average Score (%)91
Open Ko-LLM Leaderboard44.79Average (%)90.8
Open Korean LLM - Ko-GSM8K (flexible extract)53.83Exact match, flexible extract (%)87.5
Open Korean LLM - KorNAT-CKA31.74Normalized accuracy (%)87.4
Open Korean LLM - Ko-Winogrande65.75Accuracy (%)86
Open Korean LLM - Ko-GPQA-Diamond26.26Normalized accuracy (%)85.5
Open Korean LLM - Ko-IFEval36.98Strict accuracy, prompt/instruction mean (%)77.2

Interactive version: theaggregate.ai/model?slug=t3q-llm1-cv-v2-0 · How It Works · Data refreshed daily, snapshot 2026-09-19.