IndustryBench — leaderboard

Metric: Final (SV) (self-reported). Source: benchmarklist.com. 17 models tracked.

Top models

#ModelScore
1Gemini 3.1 Pro (Preview)2.08
2GPT-5.42.07
3Qwen 3.6 Plus2.07
4Claude Opus 4.62.01
5Qwen 3.5 Plus (2026-04-20)2
6Qwen 3.5 397B A17B1.99
7GPT-5.21.98
8Qwen 3.5 122B A10B1.96
9Kimi K2.51.93
10Qwen 3.5 27B1.87
11Claude Sonnet 4.61.81
12Qwen 3.5 35B A3B1.75
13Qwen 3 235B A22B1.5
14Qwen 3 32B1.39

Interactive version: theaggregate.ai/benchmark?slug=industrybench · How the rankings work · Data refreshed daily, snapshot 2026-07-22.