Unichat-llama3-Chinese-8B-28K: benchmark results

Provider: Other. Access: Open.

Unified ELO 1401 ± 16, rank #2136 of 2928 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K29.64Accuracy (%) (5-shot)46.8
Open LLM Leaderboard v1 - ARC Challenge56.74Normalized accuracy (%) (25-shot)36.1
Open LLM Leaderboard v1 - TruthfulQA MC247.01MC2 (%) (0-shot)36.1
Open LLM Leaderboard v1 - MMLU55.27Accuracy (%) (5-shot)35.8
Open LLM Leaderboard v1 - HellaSwag76.53Normalized accuracy (%) (10-shot)28.9
Open LLM Leaderboard v1 - WinoGrande69.46Accuracy (%) (5-shot)23.5
Open Chinese LLM - TruthfulQA MC50.08Accuracy (%)19.6
Open Chinese LLM - WinoGrande60.22Accuracy (%)15
Open Chinese LLM - HellaSwag53.21Accuracy (%)14.2
Open Chinese LLM - ARC Challenge42.75Accuracy (%)10.5
Open Chinese LLM - CMMLU41.55Accuracy (%)7.7
Open Chinese LLM - C-Eval Semantic44.4Accuracy (%)7.1

Interactive version: theaggregate.ai/model?slug=unichat-llama3-chinese-8b-28k · How It Works · Data refreshed daily, snapshot 2026-09-23.