NeuralExperiment-7B-MagicCoder-v7.5 — benchmark results

Kukedlc's math-, code-, and logic-focused fine-tune of his Mistral-based NeuralExperiment-7b-dare-ties merge, trained on Orca-Math and Magicoder data. Provider: Other. Released 2024-03-07. Access: Open.

Unified ELO 1414 ± 13, rank #1162 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC61.64Accuracy (%)89
Open LLM Leaderboard - MuSR13.06Score71.8
Open Chinese LLM - GSM8K47.61Accuracy (%)59.1
Open LLM Leaderboard - GPQA6.15Score51.6
Open LLM Leaderboard - IFEval45.53Score50.6
Open Chinese LLM - HellaSwag59.94Accuracy (%)48.7
Open Chinese LLM - ARC Challenge52.13Accuracy (%)48.4
Open Chinese LLM Leaderboard55.95Average Score (%)42.9
Open Chinese LLM - WinoGrande62.27Accuracy (%)39.9
Open LLM Leaderboard - MATH Level 56.65Score36
Open LLM Leaderboard - MMLU-Pro20.27Score31.7
Open LLM Leaderboard - BBH16.39Score24.9

Interactive version: theaggregate.ai/model?slug=neuralexperiment-7b-magiccoder-v7-5 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.