ProLLM - Summarization — leaderboard

ProLLM benchmark evaluating LLMs on text summarization quality for business documents.

Metric: Score (%). Source: www.prollm.ai. Status: saturated. 59 models tracked.

Top models

#ModelScore
1GPT-5 Mini98.8
2GPT-598.5
3GPT-OSS-120B98.2
4Kimi K295.9
5Grok 495.9
6GPT-5 Nano93.3
7Command A91.2
8GPT-OSS-20B83.1
9GPT-4.178
10DeepSeek V377.3
11Grok 376.5
12GPT-4.1 Mini76.4
13GPT-4.576.4
14Gemma 3 27B (IT)75.2
15DeepSeek R175

Interactive version: theaggregate.ai/benchmark?slug=prollm-summarization · How the rankings work · Data refreshed daily, snapshot 2026-07-22.