Configurable-Mistral-7B — benchmark results

Provider: Other. Released 2024-06-11. Access: Open.

Unified ELO 1336 ± 20, rank #1455 of 1776 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC59.51Accuracy (%)81.9
Open Korean LLM Leaderboard147.67Average Score (%)55
Open Chinese LLM - HellaSwag54.39Accuracy (%)20.8
Open Chinese LLM - ARC Challenge45.22Accuracy (%)16.3
Open Chinese LLM - GSM8K23.12Accuracy (%)16.3
Open Chinese LLM - WinoGrande60.3Accuracy (%)15.7
Open Chinese LLM Leaderboard47.77Average Score (%)12.2
Open Chinese LLM - CMMLU44.47Accuracy (%)11.3
Open Chinese LLM - C-Eval Semantic47.36Accuracy (%)8.3

Interactive version: theaggregate.ai/model?slug=configurable-mistral-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.