MEGA-Bench Task - Logical Reasoning Fit Pattern: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Claude 3.5 Sonnet (20241022)50
2InternVL3-78B42.9
3Claude 3.5 Sonnet (20240620)42.9
4GPT-4o28.6
5Qwen 2 VL 72B28.6
6Qwen 2 VL 7B28.6
7Qwen 2 VL 2B28.6
8Gemini 2.5 Pro (Preview 03-25)28.6
9Gemma 3 27B (IT)21.4
10Gemma 3 4B (IT)21.4
11InternVL3-8B21.4
12InternVL2-8B21.4
13Aquila-VL-2B21.4
14Gemini 1.5 Flash (002)21.4
15InternVL2.5-78B21.4

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-logical-reasoning-fit-pattern · How It Works · Data refreshed daily, snapshot 2026-09-05.