K-EXAONE: benchmark results
LG AI Research's open Korean frontier 236B MoE (23B active) with 256K context, hybrid attention and multi-token prediction (December 2025). Provider: LG AI. Released 2025-12-31. Access: Open.
Unified ELO 1685 ± 16, rank #355 of 2656 rated models, from 45 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Nejumi 4 - ALT - Toxicity | 84.17 | Score (%) | 81.2 |
| Nejumi 4 - ALT - Bias | 89.47 | Score (%) | 69.9 |
| ALL Bench LLM | 72.78 | Average Numeric Benchmark Score (%) | 68.4 |
| OpenEvals - MMLU-Pro | 83.8 | Accuracy (%) | 59.4 |
| LLM Stats Score | 26.21 | LLM Stats Score (conservative rating) | 58.7 |
| Nejumi 4 - ALT - Truthfulness | 74.12 | Score (%) | 53.9 |
| Nejumi 4 - GLP - Specialized Knowledge | 59.94 | Score (%) | 46.1 |
| Dnotitia Korean LLM Leaderboard | 83.1 | Mean Item Score (%) | 44 |
| Nejumi 4 - GLP - Logical Reasoning | 86 | Score (%) | 43.4 |
| LLM Stats (MMMLU) | 85.7 | Score (%) | 42.3 |
| OpenEvals - GPQA Diamond | 79.1 | Accuracy (%) | 42.3 |
| Nejumi 4 - ALT Average | 83.66 | Score (%) | 41.4 |
Interactive version: theaggregate.ai/model?slug=k-exaone · How It Works · Data refreshed daily, snapshot 2026-09-19.