Lingshu-32B: benchmark results

Provider: Other. Released 2025-06-05. Access: Open.

Unified ELO 1644 ± 24, rank #477 of 2656 rated models, from 23 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Medical MM Leaderboard - Average66.6Average Accuracy (%)100
Medical MM Leaderboard - OMVQA83.4Accuracy (%)100
Medical MM Leaderboard - PathVQA65.9Accuracy (%)100
Medical MM Leaderboard - SLAKE89.2Accuracy (%)100
Medical MM Leaderboard - VQA-RAD76.5Accuracy (%)100
Medical MM Leaderboard - PMC-VQA57.9Accuracy (%)90.5
MedPIC-Bench - Rule Deactivation54.4Accuracy (%)85.2
Medical MM Leaderboard - MedXQA30.9Accuracy (%)78.9
MedPIC-Bench - Counterfactual53Accuracy (%)74.1
Medical MM Leaderboard - MMMU-Med62.3Accuracy (%)71.4
MedPIC-Bench - Counterfactual Pair25.8Both-correct pair rate (%)70.4
CheXpercept89.9Stage 1 (End-to-End) (self-reported)69.2

Interactive version: theaggregate.ai/model?slug=lingshu-32b · How It Works · Data refreshed daily, snapshot 2026-09-19.