ghost-8B-beta-1608 — benchmark results

Provider: Other. Released 2024-08-18. Access: Open.

Unified ELO 1247 ± 66, rank #1622 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard168.57Average Score (%)56.8
Open Chinese LLM - WinoGrande63.22Accuracy (%)54.5
Open Chinese LLM - TruthfulQA MC53.87Accuracy (%)51.3
Open LLM Leaderboard - IFEval42.73Score44.5
Open LLM Leaderboard - MATH Level 56.95Score37.2
Open Chinese LLM - HellaSwag58.16Accuracy (%)37.1
Open LLM Leaderboard - BBH23.46Score35.4
Open LLM Leaderboard - MMLU-Pro20.44Score32
Open Chinese LLM - CMMLU49.59Accuracy (%)31.8
Open Chinese LLM - ARC Challenge46.59Accuracy (%)23.7
Open Chinese LLM - C-Eval Semantic60.99Accuracy (%)22.3
Open Chinese LLM Leaderboard47.49Average Score (%)11.3

Interactive version: theaggregate.ai/model?slug=ghost-8b-beta-1608 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.