chinese-llama-2-13B-16k: benchmark results

Provider: Other. Access: Open.

Unified ELO 1381 ± 16, rank #2276 of 2928 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - WinoGrande62.83Accuracy (%)49.1
Open LLM Leaderboard v1 - WinoGrande75.22Accuracy (%) (5-shot)41
Open LLM Leaderboard v1 - ARC Challenge55.29Normalized accuracy (%) (25-shot)33.2
Open LLM Leaderboard v1 - HellaSwag78.19Normalized accuracy (%) (10-shot)33.2
Open LLM Leaderboard v1 - MMLU50.92Accuracy (%) (5-shot)30.3
Open LLM Leaderboard v1 - GSM8K6.52Accuracy (%) (5-shot)25.7
Open Chinese LLM - HellaSwag55.04Accuracy (%)24.6
Open Chinese LLM - ARC Challenge45.82Accuracy (%)18.1
Open Chinese LLM - GSM8K10.69Accuracy (%)9.2
Open Chinese LLM Leaderboard42.37Average Score (%)6.8
Open Chinese LLM - CMMLU39.88Accuracy (%)5.9
Open Chinese LLM - C-Eval Semantic38.52Accuracy (%)5

Interactive version: theaggregate.ai/model?slug=chinese-llama-2-13b-16k · How It Works · Data refreshed daily, snapshot 2026-09-23.