NVIDIA ComputeEval - CCCL: leaderboard

Metric: Pass@1 (%, zero-shot, 2026.1 release, 80 problems). Source: huggingface.co. 20 models tracked.

Top models

#ModelScore
1Claude Opus 4.6 (High)90
2GPT-5.4 (Medium)88.8
3Claude Opus 4.6 (Medium)88.8
4GPT-5.4 (High)85
5Claude Sonnet 4.6 (High)82.5
6Gemini 3.1 Flash Lite (Medium)82.5
7GLM-5 (Thinking)81.3
8Gemini 3.1 Flash Lite (High)80
9Claude Sonnet 4.6 (Medium)78.8
10Kimi K2.5 (Thinking)77.5
11GPT-5 Mini (High)70
12GPT-5 Mini (Medium)70
13GPT-OSS-120B (High)68.8
14GPT-OSS-120B (Medium)66.3
15MiniMax-M2.558.8

Interactive version: theaggregate.ai/benchmark?slug=nvidia-computeeval-cccl · How It Works · Data refreshed daily, snapshot 2026-09-19.