MERA Code - CodeCorrectness: leaderboard

Metric: Accuracy (%). Source: mera.a-ai.ru. 66 models tracked.

Top models

#ModelScore
1GPT-5.494.27
2GPT-5.1 Codex Max91.33
3Kimi K2.589.64
4Qwen 3.6 27B87.44
5GLM-5.186.77
6Claude Opus 4.685.89
7Qwen 3.6 35B A3B84.94
8LFM2.5-1.2B Instruct84.5
9Qwen 3 32B84.13
10Qwen 2.5 1.5B Instruct83.69
11Qwen 3 30B A3B 2507 (Thinking)82.95
12Qwen 2.5 0.5B Instruct82.73
13LFM2 8B A1B82.59
14OLMo 3 7B Instruct81.56
15LFM2 24B A2B81.26

Interactive version: theaggregate.ai/benchmark?slug=mera-code-codecorrectness · How It Works · Data refreshed daily, snapshot 2026-09-05.