NeuralSynthesis-7B-v0.3 — benchmark results

Kukedlc's model-stock merge of six Mistral-7B variants (including YamshadowExperiment28 and M7-7b), built with LazyMergekit. Provider: Other. Released 2024-04-07. Access: Open.

Unified ELO 1410 ± 14, rank #1173 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC63.76Accuracy (%)94.7
Open LLM Leaderboard - MuSR13.39Score73.8
Open Chinese LLM - ARC Challenge54.01Accuracy (%)61.9
Open Chinese LLM - HellaSwag60.88Accuracy (%)59.6
Open LLM Leaderboard - BBH31.81Score58.7
Open Chinese LLM - WinoGrande63.46Accuracy (%)57.3
Open Chinese LLM Leaderboard56.96Average Score (%)57
Open Chinese LLM - GSM8K47.23Accuracy (%)56.1
Open LLM Leaderboard - IFEval40.78Score41.1
Open LLM Leaderboard - MATH Level 57.78Score40.1
Open LLM Leaderboard - MMLU-Pro22.78Score38.1
Open LLM Leaderboard - GPQA4.03Score35.2

Interactive version: theaggregate.ai/model?slug=neuralsynthesis-7b-v0-3 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.