Lingshu-7B: benchmark results

Provider: Other. Released 2025-06-05. Access: Open.

Unified ELO 1592 ± 31, rank #655 of 2656 rated models, from 23 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
CardioLens56.22F1 (Random) (self-reported)95.7
Medical MM Leaderboard - PathVQA61.9Accuracy (%)95.2
Medical MM Leaderboard - SLAKE83.1Accuracy (%)95.2
Medical MM Leaderboard - OMVQA82.9Accuracy (%)94.7
Medical MM Leaderboard - Average61.8Average Accuracy (%)83.3
ObGynLongBench - History-Level EHR - L3 Long-Horizon Reasoning58Accuracy (%)75
ObGynLongBench - Visit-Level EHR60.4Accuracy (%; same-day visit records)75
Medical MM Leaderboard - MedXQA26.7Accuracy (%)73.7
Medical MM Leaderboard - PMC-VQA56.3Accuracy (%)71.4
Medical MM Leaderboard - VQA-RAD67.9Accuracy (%)71.4
Medical MM Leaderboard - MMMU-Med54Accuracy (%)57.1
ObGynLongBench - History-Level EHR59.6Accuracy (%; full pre-decision EHR history)43.8

Interactive version: theaggregate.ai/model?slug=lingshu-7b · How It Works · Data refreshed daily, snapshot 2026-09-19.