bigstral-12B-32k — benchmark results

Provider: Other. Released 2024-03-06. Access: Open.

Unified ELO 1361 ± 26, rank #1375 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR15.86Score84.1
Open Chinese LLM - TruthfulQA MC58.81Accuracy (%)78.9
Open Korean LLM Leaderboard384.65Average Score (%)75
Open LLM Leaderboard - GPQA5.7Score47.8
Open LLM Leaderboard - IFEval41.94Score42.8
Open LLM Leaderboard - BBH25.56Score39.3
Open LLM Leaderboard - MMLU-Pro18.24Score27.8
Open Chinese LLM - WinoGrande61.4Accuracy (%)26.9
Open Chinese LLM - ARC Challenge46.5Accuracy (%)23.1
Open Chinese LLM - HellaSwag54.09Accuracy (%)19
Open Chinese LLM - CMMLU45.93Accuracy (%)15.1
Open Chinese LLM Leaderboard48.07Average Score (%)13.5

Interactive version: theaggregate.ai/model?slug=bigstral-12b-32k · How the rankings work · Data refreshed daily, snapshot 2026-07-22.