Lingshu-7B: benchmark results
Provider: Other. Released 2025-06-05. Access: Open.
Unified ELO 1592 ± 31, rank #655 of 2656 rated models, from 23 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| CardioLens | 56.22 | F1 (Random) (self-reported) | 95.7 |
| Medical MM Leaderboard - PathVQA | 61.9 | Accuracy (%) | 95.2 |
| Medical MM Leaderboard - SLAKE | 83.1 | Accuracy (%) | 95.2 |
| Medical MM Leaderboard - OMVQA | 82.9 | Accuracy (%) | 94.7 |
| Medical MM Leaderboard - Average | 61.8 | Average Accuracy (%) | 83.3 |
| ObGynLongBench - History-Level EHR - L3 Long-Horizon Reasoning | 58 | Accuracy (%) | 75 |
| ObGynLongBench - Visit-Level EHR | 60.4 | Accuracy (%; same-day visit records) | 75 |
| Medical MM Leaderboard - MedXQA | 26.7 | Accuracy (%) | 73.7 |
| Medical MM Leaderboard - PMC-VQA | 56.3 | Accuracy (%) | 71.4 |
| Medical MM Leaderboard - VQA-RAD | 67.9 | Accuracy (%) | 71.4 |
| Medical MM Leaderboard - MMMU-Med | 54 | Accuracy (%) | 57.1 |
| ObGynLongBench - History-Level EHR | 59.6 | Accuracy (%; full pre-decision EHR history) | 43.8 |
Interactive version: theaggregate.ai/model?slug=lingshu-7b · How It Works · Data refreshed daily, snapshot 2026-09-19.