AGC-Bench - lcc_metaphor — leaderboard

Metric: Dataset z-score. Source: huggingface.co. 82 models tracked.

Top models

#ModelScore
1Claude Opus 4.61.26
2Claude Opus 4.51.26
3GLM-4.71.21
4GPT-4.1 Mini1.18
5GPT-5.41.18
6Gemini 2.5 Flash1.1
7Claude Opus 4.71.1
8GPT-4o Mini1.03
9GPT-5.51.02
10GPT-5.4 Mini1.02
11Hermes 4 70B1.02
12ERNIE 4.5 300B A47B0.95
13GPT-5.10.94
14GLM-5-Turbo0.94
15Claude Sonnet 4.60.93

Interactive version: theaggregate.ai/benchmark?slug=agc-bench-lcc-metaphor · How the rankings work · Data refreshed daily, snapshot 2026-07-22.