ghost-7B-alpha: benchmark results

Provider: Lamini. Released 2024-03-01. Access: Open.

Unified ELO 1362 ± 14, rank #2157 of 2656 rated models, from 23 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-GPQA-Diamond25.76Normalized accuracy (%)81.3
Open Korean LLM - Ko-EQ-Bench11.84EQ-Bench score57.9
Open Korean LLM - Ko-IFEval30.77Strict accuracy, prompt/instruction mean (%)57.9
Open Korean LLM - Ko-GSM8K (flexible extract)8.42Exact match, flexible extract (%)31.3
Open Korean LLM Leaderboard31.9Average Score (%)29.9
Open Ko-LLM Leaderboard31.9Average (%)29.7
AlpacaEval 1.070.44Win Rate (%)26.7
Open Medical LLM - PubMedQA69.2Accuracy (%)23.9
Open Medical LLM - MMLU Anatomy50.37Accuracy (%)22.7
Open Medical LLM - MMLU College Medicine52.6Accuracy (%)21
Open Medical LLM - MMLU Clinical Knowledge57.36Accuracy (%)20.7
Open Medical LLM - MedMCQA38.06Accuracy (%)19.3

Interactive version: theaggregate.ai/model?slug=ghost-7b-alpha · How It Works · Data refreshed daily, snapshot 2026-09-19.