BioMistral-7B-DARE: benchmark results

Provider: Avignon Univ. Released 2024-02-01. Access: Open.

Unified ELO 1423 ± 14, rank #1950 of 2928 rated models, from 17 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Medical LLM - PubMedQA77.6Accuracy (%)94
Open LLM Leaderboard v1 - TruthfulQA MC255.61MC2 (%) (0-shot)65.5
Open LLM Leaderboard v1 - WinoGrande76.09Accuracy (%) (5-shot)45.9
Open LLM Leaderboard v1 - MMLU57.34Accuracy (%) (5-shot)41
Open LLM Leaderboard v1 - HellaSwag79.87Normalized accuracy (%) (10-shot)39.5
Open LLM Leaderboard v1 - ARC Challenge58.28Normalized accuracy (%) (25-shot)39.4
Open LLM Leaderboard v1 - GSM8K15.01Accuracy (%) (5-shot)37
Open Medical LLM - MMLU Clinical Knowledge66.42Accuracy (%)32.4
Open Medical LLM - MMLU College Medicine58.96Accuracy (%)31.8
Open Medical LLM - MMLU Medical Genetics68Accuracy (%)29.5
Open Medical LLM - MMLU Anatomy53.33Accuracy (%)28.7
Open Medical LLM - MedQA (USMLE)47.37Accuracy (%)28.4

Interactive version: theaggregate.ai/model?slug=biomistral-7b-dare · How It Works · Data refreshed daily, snapshot 2026-09-23.