speechless-code-mistral-7B-v1.0 — benchmark results

Provider: Other. Released 2023-10-10. Access: Open.

Unified ELO 1364 ± 16, rank #1364 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR14.77Score80.1
Open LLM Leaderboard - MMLU-Pro23.84Score42
Open LLM Leaderboard - GPQA4.59Score39.4
EvalPlus (HumanEval+ & MBPP+)45.1Pass@1 avg (%)38.7
Open LLM Leaderboard - BBH24.09Score36.7
Open LLM Leaderboard - IFEval36.65Score35.2
Open LLM Leaderboard - MATH Level 55.21Score29.1
Open Chinese LLM - TruthfulQA MC51.48Accuracy (%)28.6
Open Chinese LLM - CMMLU47.85Accuracy (%)27.6
Open Chinese LLM - WinoGrande61.17Accuracy (%)23.4
Open Chinese LLM - GSM8K27.37Accuracy (%)19.7
Open Chinese LLM - ARC Challenge45.99Accuracy (%)19.4

Interactive version: theaggregate.ai/model?slug=speechless-code-mistral-7b-v1-0 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.