NeuralLLaMa-3-8B-DT-v0.1 — benchmark results

Kukedlc's DARE TIES merge of three community Llama 3 8B variants (ChimeraLlama, Stella, and a linear merge). Provider: Other. Released 2024-05-01. Access: Open.

Unified ELO 1463 ± 26, rank #942 of 1776 rated models, from 30 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open CoT - LogiQA11.34CoT Gain (%)97.7
Open Medical LLM - PubMedQA77.6Accuracy (%)94
Open CoT - LSAT Logical Reasoning19.61CoT Gain (%)91.6
Open CoT - LogiQA 214.89CoT Gain (%)91.6
Open CoT Leaderboard13.33Average CoT Gain (%)88.5
Open Medical LLM - MedQA (USMLE)61.67Accuracy (%)87.5
Open Medical LLM - MedMCQA57.73Accuracy (%)86.6
Open Medical LLM - MMLU Medical Genetics83Accuracy (%)85.8
Open Medical LLM - MMLU College Biology79.17Accuracy (%)80.7
Open Medical LLM70.43Average Accuracy (%)79.5
Open Medical LLM - MMLU College Medicine66.47Accuracy (%)79
Open CoT - LSAT Reading Comprehension18.22CoT Gain (%)77.5

Interactive version: theaggregate.ai/model?slug=neuralllama-3-8b-dt-v0-1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.