InternVL3-78B — benchmark results
Shanghai AI Lab's open InternVL3 78B vision-language model. Provider: Shanghai AI Lab. Released 2025-04-11. Access: Open.
Unified ELO 1624 ± 5, rank #427 of 1776 rated models, from 1059 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MEGA-Bench Task - COCO Person Detection | 79.9 | Task Score (%) | 100 |
| MEGA-Bench Task - Insect Order Classification | 46.7 | Task Score (%) | 100 |
| MEGA-Bench Task - Perception Test Video Action Count | 75 | Task Score (%) | 100 |
| MEGA-Bench Task - Stack Overflow Debug QA | 71.4 | Task Score (%) | 100 |
| MEGA-Bench Task - VLN Identify Location | 57.6 | Task Score (%) | 100 |
| MEGA-Bench Task - VLNQA Egocentric Navigation Video | 62.5 | Task Score (%) | 100 |
| MEGA-Bench Task - YouTube Video Info Parsing | 89.3 | Task Score (%) | 100 |
| Open LMM Reasoning - MathVista - ARI | 74.5 | Accuracy (%) | 100 |
| Open LMM Reasoning - MathVista - MWP | 91.4 | Accuracy (%) | 100 |
| OpenVLM MMBench V1.1 CN - Physical Relation | 80 | Accuracy (%) | 100 |
| OpenVLM MME | 2538.6 | Overall Score | 100 |
| OpenVLM MME - Cognition | 753.2 | Score | 100 |
Interactive version: theaggregate.ai/model?slug=internvl3-78b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.