CCBench — leaderboard

CCBench evaluates model capability on coding & software engineering tasks from the linked upstream source with Success Rate as the primary reported metric.

Metric: Accuracy (%). Source: huggingface.co. Status: saturation imminent. 229 models tracked.

Top models

#ModelScore
1InternVL3-78B83.5
2InternVL3-38B80.6
3InternVL3-8B77.8
4InternVL2-8B77.1
5InternVL3-14B77.1
6GPT-4.1 (2025-04-14)73.5
7Qwen 2 VL 72B69.8
8Qwen 2 VL 7B65.7
9GPT-4.1 Mini64.3
10Ovis2-8B59.6
11Grok 2 (1212)57.3
12Claude 3.5 Sonnet (20241022)56.1
13MiniCPM-V-2.655.7
14Claude 3.7 Sonnet55.1
15Claude 3.5 Sonnet54.1

Interactive version: theaggregate.ai/benchmark?slug=ccbench · How the rankings work · Data refreshed daily, snapshot 2026-07-22.