ai-medical-model-32bit: benchmark results

Provider: Other. Released 2024-06-01. Access: Open.

Unified ELO 1494 ± 14, rank #1305 of 2928 rated models, from 17 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K70.05Accuracy (%) (5-shot)91.5
Open LLM Leaderboard v1 - MMLU68.1Accuracy (%) (5-shot)90.6
Open Medical LLM - MMLU Medical Genetics83Accuracy (%)85.8
Open Medical LLM - MedQA (USMLE)60.49Accuracy (%)74.7
Open Medical LLM - MMLU Professional Medicine73.53Accuracy (%)73
Open Medical LLM - MedMCQA56.8Accuracy (%)72.7
Open Medical LLM - MMLU College Medicine65.32Accuracy (%)69.3
Open Medical LLM69Average Accuracy (%)65.3
Open Medical-LLM Leaderboard69Medical average (%)64.4
Open Medical LLM - MMLU Anatomy62.96Accuracy (%)61.6
Open LLM Leaderboard v1 - TruthfulQA MC251.99MC2 (%) (0-shot)54.1
Open LLM Leaderboard v1 - ARC Challenge61.43Normalized accuracy (%) (25-shot)52.9

Interactive version: theaggregate.ai/model?slug=ai-medical-model-32bit · How It Works · Data refreshed daily, snapshot 2026-09-23.