NeuralExperiment-7B-MagicCoder-v7.5 — benchmark results
Kukedlc's math-, code-, and logic-focused fine-tune of his Mistral-based NeuralExperiment-7b-dare-ties merge, trained on Orca-Math and Magicoder data. Provider: Other. Released 2024-03-07. Access: Open.
Unified ELO 1414 ± 13, rank #1162 of 1776 rated models, from 14 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Chinese LLM - TruthfulQA MC | 61.64 | Accuracy (%) | 89 |
| Open LLM Leaderboard - MuSR | 13.06 | Score | 71.8 |
| Open Chinese LLM - GSM8K | 47.61 | Accuracy (%) | 59.1 |
| Open LLM Leaderboard - GPQA | 6.15 | Score | 51.6 |
| Open LLM Leaderboard - IFEval | 45.53 | Score | 50.6 |
| Open Chinese LLM - HellaSwag | 59.94 | Accuracy (%) | 48.7 |
| Open Chinese LLM - ARC Challenge | 52.13 | Accuracy (%) | 48.4 |
| Open Chinese LLM Leaderboard | 55.95 | Average Score (%) | 42.9 |
| Open Chinese LLM - WinoGrande | 62.27 | Accuracy (%) | 39.9 |
| Open LLM Leaderboard - MATH Level 5 | 6.65 | Score | 36 |
| Open LLM Leaderboard - MMLU-Pro | 20.27 | Score | 31.7 |
| Open LLM Leaderboard - BBH | 16.39 | Score | 24.9 |
Interactive version: theaggregate.ai/model?slug=neuralexperiment-7b-magiccoder-v7-5 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.