MultiverseEx26-7B-slerp — benchmark results

allknowingroger's SLERP merge of MTSAIR's multi_verse_model with yam-peleg's Experiment26-7B, two high-scoring Mistral leaderboard fine-tunes. Provider: Other. Released 2024-03-31. Access: Open.

Unified ELO 1408 ± 14, rank #1186 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC63.61Accuracy (%)93.8
Open LLM Leaderboard - MuSR12.6Score69.1
Open LLM Leaderboard - BBH31.66Score58
Open Chinese LLM - WinoGrande63.46Accuracy (%)57.3
Open Chinese LLM - HellaSwag60.6Accuracy (%)54.7
Open Chinese LLM - GSM8K46.63Accuracy (%)54
Open Chinese LLM - ARC Challenge53.16Accuracy (%)53.6
Open Chinese LLM Leaderboard56.62Average Score (%)50
Open LLM Leaderboard - MATH Level 57.55Score39.3
Open LLM Leaderboard - IFEval39.39Score39.2
Open LLM Leaderboard - GPQA4.36Score37.6
Open LLM Leaderboard - MMLU-Pro22.61Score37.6

Interactive version: theaggregate.ai/model?slug=multiverseex26-7b-slerp · How the rankings work · Data refreshed daily, snapshot 2026-07-22.