Ling-3.0-flash-VL: benchmark results
Provider: InclusionAI. Released 2026-09-04. Access: Open.
Unified ELO 1785 ± 27, rank #176 of 2656 rated models, from 90 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AA-Omniscience Hallucination Rate | 22.05 | Hallucination Rate (%) | 97.5 |
| Nejumi 4 - ALT - Bias | 94.45 | Score (%) | 90.6 |
| AA Long Context Reasoning | 78.33 | Accuracy (%) | 84.1 |
| AA-Omniscience Index - Science, Engineering & Mathematics | 4.1 | Omniscience Index | 83.9 |
| AA-Omniscience Index - Health | -7.4 | Omniscience Index | 83.5 |
| AA MMMU-Pro | 78.96 | Accuracy (%) | 82.3 |
| Nejumi 4 - GLP - Applied Language | 89.63 | Score (%) | 81.6 |
| AA GPQA Diamond | 86.16 | Accuracy (%) | 80.5 |
| Artificial Analysis Intelligence Index | 24.97 | Intelligence Index | 80.1 |
| AA-Omniscience Index - Humanities & Social Sciences | -1.9 | Omniscience Index | 79.8 |
| AA-Omniscience Index - Business | -5.8 | Omniscience Index | 78.9 |
| Nejumi 4 - GLP - Abstract Reasoning | 71 | Score (%) | 78.9 |
Interactive version: theaggregate.ai/model?slug=ling-3-0-flash-vl · How It Works · Data refreshed daily, snapshot 2026-09-19.