EMO-2B: benchmark results

Provider: Other. Released 2024-02-01. Access: Open.

Unified ELO 1311 ± 14, rank #2660 of 2928 rated models, from 17 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - TruthfulQA MC248.5MC2 (%) (0-shot)41.4
Open LLM Leaderboard v1 - GSM8K7.13Accuracy (%) (5-shot)26.5
Open LLM Leaderboard v1 - ARC Challenge44.97Normalized accuracy (%) (25-shot)20.6
Open LLM Leaderboard v1 - MMLU38.72Accuracy (%) (5-shot)20.4
Open LLM Leaderboard v1 - HellaSwag64.06Normalized accuracy (%) (10-shot)16.8
Open Medical LLM - PubMedQA64Accuracy (%)16.2
Open LLM Leaderboard v1 - WinoGrande62.19Accuracy (%) (5-shot)15.3
Open Medical LLM - MMLU College Biology40.28Accuracy (%)15.3
Open Medical LLM - MMLU Anatomy41.48Accuracy (%)15.1
Open Medical LLM39.48Average Accuracy (%)14.8
Open Medical LLM - MMLU College Medicine34.1Accuracy (%)14.5
Open Medical-LLM Leaderboard39.48Medical average (%)14.4

Interactive version: theaggregate.ai/model?slug=emo-2b · How It Works · Data refreshed daily, snapshot 2026-09-23.