Llama 3 8B Slerp Biomed Chat Chinese: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1482 ± 13, rank #1438 of 2928 rated models, from 25 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Medical LLM - MedQA (USMLE)63.55Accuracy (%)94.3
Open Medical LLM - MMLU College Medicine68.79Accuracy (%)90.1
Open Medical LLM - MMLU Professional Medicine75Accuracy (%)83.5
Open Medical LLM70.78Average Accuracy (%)83
Open Medical-LLM Leaderboard70.78Medical average (%)81.7
Open Medical LLM - MMLU Clinical Knowledge75.09Accuracy (%)81.5
Open LLM Leaderboard v1 - MMLU65.08Accuracy (%) (5-shot)81.4
Open Medical LLM - MMLU Anatomy65.93Accuracy (%)73.9
Open Medical LLM - PubMedQA75.2Accuracy (%)71
Open Medical LLM - MMLU College Biology77.08Accuracy (%)67.9
Open Medical LLM - MMLU Medical Genetics80Accuracy (%)67
Open Medical LLM - MedMCQA56.39Accuracy (%)67

Interactive version: theaggregate.ai/model?slug=llama-3-8b-slerp-biomed-chat-chinese · How It Works · Data refreshed daily, snapshot 2026-09-23.