Hebrew-Mistral-7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1432 ± 19, rank #1879 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K30.33Accuracy (%) (5-shot)47.4
Open LLM Leaderboard v1 - MMLU59.52Accuracy (%) (5-shot)45.3
Open LLM Leaderboard v1 - ARC Challenge59.73Normalized accuracy (%) (25-shot)44.7
Open LLM Leaderboard v1 - HellaSwag80.77Normalized accuracy (%) (10-shot)42.4
Open LLM Leaderboard - MuSR39.77Score40.1
Open LLM Leaderboard v1 - TruthfulQA MC248.16MC2 (%) (0-shot)40
Open LLM Leaderboard v1 - WinoGrande74.03Accuracy (%) (5-shot)34.6
Open LLM Leaderboard - GPQA27.94Score34.3
Open LLM Leaderboard - MMLU-Pro27.8Score30.5
Open LLM Leaderboard - BBH43.34Score30.3
Open LLM Leaderboard - MATH Level 54.98Score27.9
Open LLM Leaderboard - IFEval23.28Score16.8

Interactive version: theaggregate.ai/model?slug=hebrew-mistral-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.