bigstral-12B-32k: benchmark results

Provider: Other. Released 2024-03-06. Access: Open.

Unified ELO 1405 ± 1, rank #1115 of 1392 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR15.86Score84.1
Open Chinese LLM - TruthfulQA MC58.81Accuracy (%)78.9
Open LLM Leaderboard - GPQA5.7Score47.8
Open Korean LLM Leaderboard35Average Score (%)46.9
Open LLM Leaderboard - IFEval41.94Score42.8
Open LLM Leaderboard - BBH25.56Score39.3
Open LLM Leaderboard - MMLU-Pro18.24Score27.8
Open Chinese LLM - WinoGrande61.4Accuracy (%)26.9
Open Chinese LLM - ARC Challenge46.5Accuracy (%)23.1
Open Chinese LLM - HellaSwag54.09Accuracy (%)19
Open Chinese LLM - CMMLU45.93Accuracy (%)15.1
Open Chinese LLM Leaderboard48.07Average Score (%)13.5

Interactive version: theaggregate.ai/model?slug=bigstral-12b-32k · How It Works · Data refreshed daily, snapshot 2026-09-05.