Collaiborator-MEDLLM-Llama-3-8B-v1: benchmark results

Provider: Other. Released 2024-06-01. Access: Open.

Unified ELO 1479 ± 14, rank #1465 of 2928 rated models, from 17 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - MMLU65.95Accuracy (%) (5-shot)85.5
Open LLM Leaderboard v1 - GSM8K63.53Accuracy (%) (5-shot)77
Open Medical LLM - MedQA (USMLE)59.62Accuracy (%)64.8
Open Medical LLM - MedMCQA55.99Accuracy (%)63.6
Open Medical LLM - MMLU Clinical Knowledge72.45Accuracy (%)62.5
Open Medical LLM - MMLU College Biology75.69Accuracy (%)59.1
Open LLM Leaderboard v1 - TruthfulQA MC252.91MC2 (%) (0-shot)57.9
Open Medical LLM - MMLU Anatomy60.74Accuracy (%)52.6
Open Medical LLM66.67Average Accuracy (%)51.7
Open Medical-LLM Leaderboard66.67Medical average (%)50.6
Open Medical LLM - MMLU Professional Medicine69.49Accuracy (%)49.7
Open LLM Leaderboard v1 - WinoGrande76.64Accuracy (%) (5-shot)49.6

Interactive version: theaggregate.ai/model?slug=collaiborator-medllm-llama-3-8b-v1 · How It Works · Data refreshed daily, snapshot 2026-09-23.