bigyi-15B: benchmark results

Provider: Other. Released 2024-03-06. Access: Open.

Unified ELO 1363 ± 1, rank #1236 of 1392 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - C-Eval Semantic78.47Accuracy (%)68
Open LLM Leaderboard - GPQA7.94Score67.1
Open Chinese LLM - CMMLU57.47Accuracy (%)64.1
Open Chinese LLM - ARC Challenge52.65Accuracy (%)50.6
Open Chinese LLM - HellaSwag59.39Accuracy (%)43.9
Open Chinese LLM - WinoGrande62.27Accuracy (%)39.9
Open LLM Leaderboard - MMLU-Pro22.25Score36.4
Open Chinese LLM Leaderboard53.23Average Score (%)30
Open LLM Leaderboard - BBH19.94Score29.9
Open LLM Leaderboard - MuSR4.29Score21.1
Open LLM Leaderboard - MATH Level 52.95Score18.6
Open Korean LLM Leaderboard31.31Average Score (%)14.9

Interactive version: theaggregate.ai/model?slug=bigyi-15b · How It Works · Data refreshed daily, snapshot 2026-09-05.