MERA - ruHateSpeech: leaderboard

Metric: Accuracy (%). Source: mera.a-ai.ru. 630 models tracked.

Top models

#ModelScore
1GPT-5.494.72
2GLM-5.193.96
3Qwen 3.6 27B93.21
4Qwen 3.5 27B92.83
5Qwen 3.5 122B A10B92.83
6Qwen 3 235B A22B 2507 (Thinking)92.83
7Qwen 3.6 35B A3B92.08
8Qwen 3 30B A3B 2507 (Thinking)92.08
9Claude Opus 4.691.32
10Kimi K2.590.94
11GPT-5.290.57
12Qwen 3 32B90.19
13Claude Opus 4.590.19
14Qwen 3.5 35B A3B89.81
15Qwen 3 14B88.68

Interactive version: theaggregate.ai/benchmark?slug=mera-ruhatespeech · How It Works · Data refreshed daily, snapshot 2026-09-05.