LLM2014 Code 2025-11 - Golang — leaderboard

Metric: Score. Source: raw.githubusercontent.com. 26 models tracked.

Top models

#ModelScore
1GPT-5 Mini (High)9.2
2Claude Opus 4.59.1
3Gemini 2.5 Pro8.87
4Gemini 3 Pro7.93
5Claude Sonnet 4.57.85
6DeepSeek V3.2 (Thinking)7.25
7Claude Sonnet 4.5 (Thinking)7.18
8Kimi K2 (Thinking)5.95
9GLM-4.6 (Thinking)5.7
10Kimi K2 09055.67
11DeepSeek V3.25.62
12Claude Haiku 4.55.03
13Ling-1T3.67
14MiniMax-M23.2
15GLM-4.62.87

Interactive version: theaggregate.ai/benchmark?slug=llm2014-code-2025-11-golang · How the rankings work · Data refreshed daily, snapshot 2026-07-22.