Configurable-Mistral-7B: benchmark results

Provider: Other. Released 2024-06-11. Access: Open.

Unified ELO 1381 ± 1, rank #1194 of 1392 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC59.51Accuracy (%)81.9
Open Korean LLM Leaderboard35.03Average Score (%)47.1
Open Chinese LLM - HellaSwag54.39Accuracy (%)20.8
Open Chinese LLM - ARC Challenge45.22Accuracy (%)16.3
Open Chinese LLM - GSM8K23.12Accuracy (%)16.3
Open Chinese LLM - WinoGrande60.3Accuracy (%)15.7
Open Chinese LLM Leaderboard47.77Average Score (%)12.2
Open Chinese LLM - CMMLU44.47Accuracy (%)11.3
Open Chinese LLM - C-Eval Semantic47.36Accuracy (%)8.3

Interactive version: theaggregate.ai/model?slug=configurable-mistral-7b · How It Works · Data refreshed daily, snapshot 2026-09-05.