NeuralLLaMa-3-8B-DT-v0.1 — benchmark results
Kukedlc's DARE TIES merge of three community Llama 3 8B variants (ChimeraLlama, Stella, and a linear merge). Provider: Other. Released 2024-05-01. Access: Open.
Unified ELO 1463 ± 26, rank #942 of 1776 rated models, from 30 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open CoT - LogiQA | 11.34 | CoT Gain (%) | 97.7 |
| Open Medical LLM - PubMedQA | 77.6 | Accuracy (%) | 94 |
| Open CoT - LSAT Logical Reasoning | 19.61 | CoT Gain (%) | 91.6 |
| Open CoT - LogiQA 2 | 14.89 | CoT Gain (%) | 91.6 |
| Open CoT Leaderboard | 13.33 | Average CoT Gain (%) | 88.5 |
| Open Medical LLM - MedQA (USMLE) | 61.67 | Accuracy (%) | 87.5 |
| Open Medical LLM - MedMCQA | 57.73 | Accuracy (%) | 86.6 |
| Open Medical LLM - MMLU Medical Genetics | 83 | Accuracy (%) | 85.8 |
| Open Medical LLM - MMLU College Biology | 79.17 | Accuracy (%) | 80.7 |
| Open Medical LLM | 70.43 | Average Accuracy (%) | 79.5 |
| Open Medical LLM - MMLU College Medicine | 66.47 | Accuracy (%) | 79 |
| Open CoT - LSAT Reading Comprehension | 18.22 | CoT Gain (%) | 77.5 |
Interactive version: theaggregate.ai/model?slug=neuralllama-3-8b-dt-v0-1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.