Nanbeige-16B-Base-Llama: benchmark results

Provider: Nanbeige. Access: Open.

Unified ELO 1463 ± 16, rank #1607 of 2928 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - WinoGrande66.22Accuracy (%)77
Open LLM Leaderboard v1 - GSM8K47.01Accuracy (%) (5-shot)60.6
Open LLM Leaderboard v1 - MMLU63.34Accuracy (%) (5-shot)60
Open Chinese LLM - HellaSwag60.86Accuracy (%)59.1
Open Chinese LLM - C-Eval Semantic70.87Accuracy (%)54.3
Open Chinese LLM - CMMLU54.17Accuracy (%)54
Open LLM Leaderboard v1 - WinoGrande75.77Accuracy (%) (5-shot)44
Open Chinese LLM Leaderboard54.98Average Score (%)37.1
Open LLM Leaderboard v1 - HellaSwag78.97Normalized accuracy (%) (10-shot)36.4
Open LLM Leaderboard v1 - ARC Challenge56.48Normalized accuracy (%) (25-shot)35.6
Open Chinese LLM - ARC Challenge48.46Accuracy (%)34.4
Open Chinese LLM - GSM8K35.48Accuracy (%)31.3

Interactive version: theaggregate.ai/model?slug=nanbeige-16b-base-llama · How It Works · Data refreshed daily, snapshot 2026-09-23.