Gigi-Llama3-8B-Chinese-zh: benchmark results
Provider: Other. Access: Open.
Unified ELO 1482 ± 16, rank #1440 of 2928 rated models, from 14 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard v1 - MMLU | 66.91 | Accuracy (%) (5-shot) | 88.5 |
| Open LLM Leaderboard v1 - GSM8K | 66.79 | Accuracy (%) (5-shot) | 82.5 |
| Open Chinese LLM - C-Eval Semantic | 74.19 | Accuracy (%) | 63.1 |
| Open Chinese LLM - GSM8K | 48.82 | Accuracy (%) | 62.9 |
| Open Chinese LLM - CMMLU | 54.51 | Accuracy (%) | 57.9 |
| Open Chinese LLM Leaderboard | 56.89 | Average Score (%) | 56.1 |
| Open LLM Leaderboard v1 - TruthfulQA MC2 | 52.14 | MC2 (%) (0-shot) | 54.8 |
| Open Chinese LLM - TruthfulQA MC | 54.05 | Accuracy (%) | 54 |
| Open LLM Leaderboard v1 - WinoGrande | 76.48 | Accuracy (%) (5-shot) | 48.5 |
| Open LLM Leaderboard v1 - ARC Challenge | 59.64 | Normalized accuracy (%) (25-shot) | 44.3 |
| Open LLM Leaderboard v1 - HellaSwag | 80.28 | Normalized accuracy (%) (10-shot) | 40.6 |
| Open Chinese LLM - HellaSwag | 58.26 | Accuracy (%) | 39.2 |
Interactive version: theaggregate.ai/model?slug=gigi-llama3-8b-chinese-zh · How It Works · Data refreshed daily, snapshot 2026-09-23.