MEGA-Bench Task - Stock Info Parsing — leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1GPT-4o97.5
2InternVL3-78B97.5
3Qwen 2 VL 72B97.5
4Qwen 2 VL 7B97.5
5Claude 3.5 Sonnet (20241022)97.5
6Claude 3.5 Sonnet (20240620)97.5
7Ovis2-8B97.1
8GPT-4o Mini97.1
9Gemini 2.5 Pro96.6
10Gemini 2.0 Flash (Preview)96.6
11InternVL3-8B96.2
12InternVL2.5-78B96.2
13Gemma 3 27B (IT)95.4
14InternVL3-14B95
15Gemma 3 12B (IT)94.5

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-stock-info-parsing · How the rankings work · Data refreshed daily, snapshot 2026-07-22.