InternVL3.5-8B — benchmark results

OpenGVLab's 8B InternVL3.5 vision-language model (August 2025) with a Qwen3 backbone and Cascade RL training for multimodal reasoning. Provider: Shanghai AI Lab. Released 2025-08-26. Access: Open.

Unified ELO 1427 ± 25, rank #1095 of 1776 rated models, from 36 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AgroVG39.6All@.5 (self-reported)91.7
CardioLens52.51F1 Score (Random) (self-reported)82.6
EVALITA - faq53.86CPS72.3
EVALITA - summarization-fanpage28.49CPS70.2
MathVision52.05Overall Accuracy (%)62.7
Math-VR40.8Overall Answer Correctness (self-reported)56.7
MedLayXPlain58.7S (self-reported)54.8
EVALITA - text-entailment74.32CPS51.1
C3-Bench4.44Aggregation (self-reported)43.8
EVALITA - word-in-context62.07CPS42.6
VSI-Super-Wild32.18Overall Accuracy (%)41.7
OCR-Robust57.26OCR1.0 Clean (self-reported)40

Interactive version: theaggregate.ai/model?slug=internvl3-5-8b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.