ChimeraLlama-3-8B-v3 — benchmark results

mlabonne's DARE TIES merge of seven Llama 3 8B fine-tunes (Instruct, Dolphin 2.9, OrpoLlama and others) on the Meta-Llama-3-8B base. Provider: Other. Released 2024-06-01. Access: Open.

Unified ELO 1404 ± 9, rank #1203 of 1776 rated models, from 24 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Medical LLM - MMLU Medical Genetics83Accuracy (%)85.8
Open Medical LLM - MedQA (USMLE)61.27Accuracy (%)84.7
Open Medical LLM - PubMedQA76.4Accuracy (%)83.5
Open Medical LLM - MedMCQA57.35Accuracy (%)81.2
Open Medical LLM - MMLU Professional Medicine74.63Accuracy (%)80.7
Open Medical LLM70.04Average Accuracy (%)75
Open Chinese LLM - GSM8K51.25Accuracy (%)70
Open Medical LLM - MMLU Anatomy65.19Accuracy (%)68.8
Open Medical LLM - MMLU College Biology77.08Accuracy (%)67.9
Open Medical LLM - MMLU College Medicine64.16Accuracy (%)60.5
Open LLM Leaderboard - MMLU-Pro29.65Score58.1
Open Chinese LLM Leaderboard56.99Average Score (%)57.3

Interactive version: theaggregate.ai/model?slug=chimerallama-3-8b-v3 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.