Horangi 4 - Korean Hate Speech: leaderboard

Metric: Accuracy (%). Source: horangi.ai. 105 models tracked.

Top models

#ModelScore
1Claude Fable 5 (High)78
2Gemma 3 27B (IT)74
3EXAONE-3.0-7.8B-Instruct71
4Grok 4.1 Fast (Non-reasoning)70
5DeepSeek V3.2 (High)70
6Mistral Medium 3.569
7Grok 4.2069
8GLM-5-Turbo69
9Claude Opus 4.6 (High)69
10Qwen 3.5 397B A17B67
11Mistral Small 467
12Claude Sonnet 4.6 (High)67
13A.X 4.067
14Gemma 3 12B (IT)66
15Qwen 3.7 Max66

Interactive version: theaggregate.ai/benchmark?slug=horangi-4-korean-hate-speech · How It Works · Data refreshed daily, snapshot 2026-09-19.