BioMistral-7B: benchmark results

Provider: Avignon Univ. Released 2024-02-01. Access: Open.

Unified ELO 1379 ± 13, rank #2295 of 2928 rated models, from 33 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - TruthfulQA MC251.61MC2 (%) (0-shot)52.6
Open Korean LLM - KorNAT-Helpful46.45Normalized accuracy (%)46.5
Open LLM Leaderboard v1 - HellaSwag79.09Normalized accuracy (%) (10-shot)36.7
Open LLM Leaderboard v1 - MMLU55.56Accuracy (%) (5-shot)36.6
Open LLM Leaderboard v1 - WinoGrande73.48Accuracy (%) (5-shot)32.3
Open LLM Leaderboard v1 - ARC Challenge54.27Normalized accuracy (%) (25-shot)31.1
MEDIC Benchmark58.59MEDIC Public Table Average29.5
Open Korean LLM - KorNAT-Harmless61.41Normalized accuracy (%)28.3
Open Medical LLM - MMLU Clinical Knowledge63.77Accuracy (%)26.4
Open Medical LLM - PubMedQA71Accuracy (%)25.6
Open Medical LLM - MedQA (USMLE)46.11Accuracy (%)25
Open Medical LLM - MMLU Medical Genetics66Accuracy (%)24.4

Interactive version: theaggregate.ai/model?slug=biomistral-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.