MEGA-Bench Task - Stock Info Parsing: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1GPT-4o97.5
2InternVL3-78B97.5
3Qwen 2 VL 72B97.5
4Qwen 2 VL 7B97.5
5Claude 3.5 Sonnet (20241022)97.5
6Claude 3.5 Sonnet (20240620)97.5
7GPT-4o Mini97.1
8Gemini 2.5 Pro (Preview 03-25)96.6
9InternVL3-8B96.2
10InternVL2.5-78B96.2
11Gemma 3 27B (IT)95.4
12Gemma 3 12B (IT)94.5
13InternVL3-38B94.5
14Llama 4 Scout Base92.9
15Qwen 2 VL 2B92

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-stock-info-parsing · How It Works · Data refreshed daily, snapshot 2026-09-05.