MEGA-Bench Task - SciBench Fundamental Without Solution: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro (Preview 03-25)57.1
2GPT-4o34.7
3Gemini 1.5 Flash (002)34.7
4Gemini 1.5 Pro (002)30.6
5Gemma 3 27B (IT)28.6
6Claude 3.5 Sonnet (20240620)28.6
7InternVL3-78B26.5
8GPT-4o Mini26.5
9InternVL2.5-78B26.5
10Claude 3.5 Sonnet (20241022)24.5
11Llama 4 Scout Base24.5
12InternVL3-38B22.4
13Qwen 2 VL 72B18.4
14Gemma 3 12B (IT)16.3
15InternVL3-8B14.3

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-scibench-fundamental-without-solution · How It Works · Data refreshed daily, snapshot 2026-09-05.