Llama3.1-Aloe-Beta-8B: benchmark results

Provider: Meta. Released 2024-10-30. Access: Open.

Unified ELO 1510 ± 1, rank #648 of 1392 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MedS-Bench - Diagnosis60.67Score90.9
MedS-Bench - Text Classification73.45Score90.9
MedS-Bench - Named Entity Recognition59.71Score90
Open LLM Leaderboard - IFEval72.53Score86.4
MedS-Bench - Text Summarization25.05Score72.7
MedS-Bench - Concept Explanation13.63Score68.2
Open LLM Leaderboard - MATH Level 518.28Score67.9
MedS-Bench - Treatment Planning66.67Score54.5
Open LLM Leaderboard - MMLU-Pro28.67Score54.1
Open LLM Leaderboard - BBH30.37Score53.1
MedS-Bench - Information Extraction71.32Score36.4
Open LLM Leaderboard - MuSR6.83Score32.3

Interactive version: theaggregate.ai/model?slug=llama3-1-aloe-beta-8b · How It Works · Data refreshed daily, snapshot 2026-09-05.