LLM2014 Code 2025-09 - TypeScript — leaderboard

Metric: Score. Source: raw.githubusercontent.com. 20 models tracked.

Top models

#ModelScore
1DeepSeek V3.1 (Thinking)9.38
2Claude Sonnet 4 (Thinking)8.89
3GLM-4.5 (Thinking)8.89
4GPT-5 Mini (High)8.75
5Gemini 2.5 Pro8.51
6DeepSeek V3.18.06
7O4 Mini (High)8.06
8Claude Sonnet 47.71
9GLM-4.56.94
10Qwen 3 235B A22B 2507 Instruct5.97
11GPT-OSS-120B (High)5.97
12Grok Code Fast 15.91
13GPT-OSS-20B (High)5.89
14Gemini 2.5 Flash (Thinking)5.15
15Grok 44.39

Interactive version: theaggregate.ai/benchmark?slug=llm2014-code-2025-09-typescript · How the rankings work · Data refreshed daily, snapshot 2026-07-22.