NVIDIA ComputeEval - cuBLAS: leaderboard

Metric: Pass@1 (%, zero-shot, 2026.1 release, 81 problems). Source: huggingface.co. 20 models tracked.

Top models

#ModelScore
1Claude Sonnet 4.6 (High)98.8
2Claude Opus 4.6 (High)96.3
3Claude Opus 4.6 (Medium)96.3
4GPT-5.4 (High)95.1
5Claude Sonnet 4.6 (Medium)95.1
6GPT-5.4 (Medium)93.8
7Kimi K2.5 (Thinking)91.4
8GPT-5 Mini (High)87.7
9GPT-OSS-120B (High)85.2
10Gemini 3.1 Flash Lite (High)84
11GLM-5 (Thinking)82.7
12GPT-5 Mini (Medium)81.5
13GPT-OSS-120B (Medium)81.5
14Gemini 3.1 Flash Lite (Medium)80.2
15GPT-OSS-20B (Medium)69.1

Interactive version: theaggregate.ai/benchmark?slug=nvidia-computeeval-cublas · How It Works · Data refreshed daily, snapshot 2026-09-19.