BeagSake-7B — benchmark results

Provider: Other. Released 2024-03-01. Access: Open.

Unified ELO 1401 ± 11, rank #1220 of 1776 rated models, from 25 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC61.95Accuracy (%)89.9
Open Medical LLM - PubMedQA76Accuracy (%)80.1
Open Korean LLM Leaderboard367.39Average Score (%)73.1
Open LLM Leaderboard - IFEval52.16Score62.2
Open Medical LLM - MMLU College Medicine64.16Accuracy (%)60.5
Open Chinese LLM - GSM8K47.16Accuracy (%)55
Open Chinese LLM - HellaSwag60.08Accuracy (%)49.7
Open Chinese LLM - ARC Challenge52.22Accuracy (%)48.7
Open LLM Leaderboard - MuSR9.84Score48.6
Open Medical LLM - MMLU Clinical Knowledge70.57Accuracy (%)48.3
Open Chinese LLM Leaderboard56.47Average Score (%)48.1
Open Medical LLM - MMLU Anatomy59.26Accuracy (%)46.3

Interactive version: theaggregate.ai/model?slug=beagsake-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.