bigyi-15B — benchmark results

Provider: Other. Released 2024-03-06. Access: Open.

Unified ELO 1332 ± 28, rank #1468 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - C-Eval Semantic78.47Accuracy (%)68
Open LLM Leaderboard - GPQA7.94Score67
Open Chinese LLM - CMMLU57.47Accuracy (%)64.1
Open Chinese LLM - ARC Challenge52.65Accuracy (%)50.6
Open Chinese LLM - HellaSwag59.39Accuracy (%)43.9
Open Chinese LLM - WinoGrande62.27Accuracy (%)39.9
Open LLM Leaderboard - MMLU-Pro22.25Score36.4
Open Chinese LLM Leaderboard53.23Average Score (%)30
Open LLM Leaderboard - BBH19.94Score29.9
Open LLM Leaderboard - MuSR4.29Score21.1
Open LLM Leaderboard - MATH Level 52.95Score18.6
Open Korean LLM Leaderboard31.31Average Score (%)16.4

Interactive version: theaggregate.ai/model?slug=bigyi-15b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.