InternVL3-78B: benchmark results
Shanghai AI Lab's open InternVL3 78B vision-language model. Provider: Shanghai AI Lab. Released 2025-04-11. Access: Open.
Unified ELO 1592 ± 1, rank #285 of 1392 rated models, from 1061 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MEGA-Bench Task - COCO Person Detection | 79.9 | Task Score (%) | 100 |
| MEGA-Bench Task - Insect Order Classification | 46.7 | Task Score (%) | 100 |
| MEGA-Bench Task - Perception Test Video Action Count | 75 | Task Score (%) | 100 |
| MEGA-Bench Task - Stack Overflow Debug QA | 71.4 | Task Score (%) | 100 |
| MEGA-Bench Task - VLN Identify Location | 57.6 | Task Score (%) | 100 |
| MEGA-Bench Task - VLNQA Egocentric Navigation Video | 62.5 | Task Score (%) | 100 |
| MEGA-Bench Task - YouTube Video Info Parsing | 89.3 | Task Score (%) | 100 |
| OpenVLM MMBench V1.1 CN - Physical Relation | 80 | Accuracy (%) | 100 |
| OpenVLM MME | 2538.6 | Overall Score | 100 |
| OpenVLM MME - Cognition | 753.2 | Score | 100 |
| OpenVLM MME - Perception | 1785.3 | Score | 100 |
| OpenVLM MME - Position | 180 | Score | 100 |
Interactive version: theaggregate.ai/model?slug=internvl3-78b · How It Works · Data refreshed daily, snapshot 2026-09-05.