TeamBench — leaderboard

Metric: Solo (self-reported). Source: benchmarklist.com. 13 models tracked.

Top models

#ModelScore
1Claude Opus 4.735.6
2GPT-5.4 Mini33.3
3Gemini 3.1 Pro (Preview)27.8
4Gemma 4 31B27.8
5GPT-OSS-20B17.8
6Gemini 3 Flash (Preview)13.3
7GPT-5.412.2
8Claude Haiku 4.512.2
9Claude Sonnet 4.67.8
10Qwen 3 14B5.6
11Qwen 3 32B5.6
12Gemini 3.1 Flash Lite5.6
13Qwen 3 8B2.2

Interactive version: theaggregate.ai/benchmark?slug=teambench · How the rankings work · Data refreshed daily, snapshot 2026-07-22.