QIMMA - 3LM HumanEval+: leaderboard

Metric: pass@1 (%). Source: huggingface.co. 83 models tracked.

Top models

#ModelScore
1Qwen 3.6 27B86.59
2Qwen 3.5 122B A10B85.98
3Qwen 3.5 27B84.76
4Qwen 3 235B A22B 2507 Instruct84.76
5Qwen 3.5 397B A17B84.15
6Qwen 3.6 35B A3B83.54
7Qwen 3.5 35B A3B81.1
8Qwen 3.8 27B79.88
9Qwen 3 30B A3B 2507 Instruct78.66
10gemma-4-E4B-it77.44
11Qwen 2.5 72B Instruct75.61
12Gemma 3 27B (IT)75
13GPT-OSS-20B74.39
14Qwen 2.5 32B Instruct73.78
15Qwen 3.5 9B73.17

Interactive version: theaggregate.ai/benchmark?slug=qimma-3lm-humaneval-plus · How It Works · Data refreshed daily, snapshot 2026-09-19.