MEGA-Bench Task - Figurative Speech Explanation: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Gemma 3 27B (IT)86.9
2Gemini 2.5 Pro (Preview 03-25)84.8
3Gemma 3 12B (IT)84.1
4GPT-4o Mini83.8
5GPT-4o83.1
6Claude 3.5 Sonnet (20240620)83.1
7Gemini 1.5 Pro (002)81.4
8Gemini 1.5 Flash (002)81.4
9Gemma 3 4B (IT)79
10Claude 3.5 Sonnet (20241022)78.6
11InternVL3-78B78.3
12InternVL3-38B78.3
13Llama 4 Scout Base77.2
14Qwen 2 VL 72B75.9
15InternVL2.5-78B73.4

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-figurative-speech-explanation · How It Works · Data refreshed daily, snapshot 2026-09-05.