Open Medical LLM - MedMCQA — leaderboard
Metric: Accuracy (%). Source: huggingface.co. 181 models tracked.
Top models
| # | Model | Score |
|---|---|---|
| 1 | NeuralLLaMa-3-8B-ORPO-v0.3 | 58.52 |
| 2 | Daredevil-8B-abliterated | 58.36 |
| 3 | NeuralLLaMa-3-8B-DT-v0.1 | 57.73 |
| 4 | Llama 3 8B | 57.47 |
| 5 | ChimeraLlama-3-8B-v3 | 57.35 |
| 6 | Llama 3 8B Ita | 57.04 |
| 7 | Llama 3 8B Instruct | 56.85 |
| 8 | Llama-3-SauerkrautLM-8B-Instruct | 56.73 |
| 9 | Barcenas-Llama3-8B-ORPO | 56.68 |
| 10 | Meta-Llama-3-8B-Instruct-abliterated-v3 | 56.63 |
| 11 | suzume-llama-3-8B-multilingual | 56.61 |
| 12 | Llama-3-8B-Instruct-abliterated-v2 | 56.32 |
| 13 | Llama-3-Smaug-8B | 56.08 |
| 14 | Yi-1.5-9B | 53.26 |
| 15 | Liberated-Qwen1.5-14B | 52.83 |
Interactive version: theaggregate.ai/benchmark?slug=open-medical-llm-medmcqa · How the rankings work · Data refreshed daily, snapshot 2026-07-22.