ai-medical-model-32bit: benchmark results
Provider: Other. Released 2024-06-01. Access: Open.
Unified ELO 1494 ± 14, rank #1305 of 2928 rated models, from 17 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard v1 - GSM8K | 70.05 | Accuracy (%) (5-shot) | 91.5 |
| Open LLM Leaderboard v1 - MMLU | 68.1 | Accuracy (%) (5-shot) | 90.6 |
| Open Medical LLM - MMLU Medical Genetics | 83 | Accuracy (%) | 85.8 |
| Open Medical LLM - MedQA (USMLE) | 60.49 | Accuracy (%) | 74.7 |
| Open Medical LLM - MMLU Professional Medicine | 73.53 | Accuracy (%) | 73 |
| Open Medical LLM - MedMCQA | 56.8 | Accuracy (%) | 72.7 |
| Open Medical LLM - MMLU College Medicine | 65.32 | Accuracy (%) | 69.3 |
| Open Medical LLM | 69 | Average Accuracy (%) | 65.3 |
| Open Medical-LLM Leaderboard | 69 | Medical average (%) | 64.4 |
| Open Medical LLM - MMLU Anatomy | 62.96 | Accuracy (%) | 61.6 |
| Open LLM Leaderboard v1 - TruthfulQA MC2 | 51.99 | MC2 (%) (0-shot) | 54.1 |
| Open LLM Leaderboard v1 - ARC Challenge | 61.43 | Normalized accuracy (%) (25-shot) | 52.9 |
Interactive version: theaggregate.ai/model?slug=ai-medical-model-32bit · How It Works · Data refreshed daily, snapshot 2026-09-23.