Korean LLM Eval - CLIcK — leaderboard

Metric: Accuracy (%, 0-shot). Source: github.com. 24 models tracked.

Top models

#ModelScore
1GPT-5.2 (Medium)90.92
2GPT-5.1 (Medium)89.81
3GPT-5.282.75
4GPT-5 Mini82.17
5GPT-5.181
6GPT-5 Chat80.84
7GPT-4.180.55
8GPT-4o80.46
9GPT-5.1 ChatGPT77.97
10GPT-4 Turbo72.82
11GPT-4.1 Mini72.09
12GPT-5 Nano72.05
13GPT-4o Mini68.5
14GPT-4.1 Nano61.21
15Phi-459.15

Interactive version: theaggregate.ai/benchmark?slug=korean-llm-eval-click · How It Works · Data refreshed daily, snapshot 2026-07-27.