Gigi-Llama3-8B-Chinese-zh: benchmark results

Provider: Other. Access: Open.

Unified ELO 1482 ± 16, rank #1440 of 2928 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - MMLU66.91Accuracy (%) (5-shot)88.5
Open LLM Leaderboard v1 - GSM8K66.79Accuracy (%) (5-shot)82.5
Open Chinese LLM - C-Eval Semantic74.19Accuracy (%)63.1
Open Chinese LLM - GSM8K48.82Accuracy (%)62.9
Open Chinese LLM - CMMLU54.51Accuracy (%)57.9
Open Chinese LLM Leaderboard56.89Average Score (%)56.1
Open LLM Leaderboard v1 - TruthfulQA MC252.14MC2 (%) (0-shot)54.8
Open Chinese LLM - TruthfulQA MC54.05Accuracy (%)54
Open LLM Leaderboard v1 - WinoGrande76.48Accuracy (%) (5-shot)48.5
Open LLM Leaderboard v1 - ARC Challenge59.64Normalized accuracy (%) (25-shot)44.3
Open LLM Leaderboard v1 - HellaSwag80.28Normalized accuracy (%) (10-shot)40.6
Open Chinese LLM - HellaSwag58.26Accuracy (%)39.2

Interactive version: theaggregate.ai/model?slug=gigi-llama3-8b-chinese-zh · How It Works · Data refreshed daily, snapshot 2026-09-23.