SauerkrautLM-Nemo-12B-Instruct — benchmark results

VAGOsolutions' German-English Spectrum fine-tune of Mistral-Nemo-Instruct-2407 (12B), targeting 25% of layers to preserve base knowledge (July 2024). Provider: VAGOsolutions. Released 2024-07-22. Access: Open.

Unified ELO 1469 ± 11, rank #911 of 1776 rated models, from 129 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Arabic LLM - Alghafa Multiple Choice Rating Sentiment NO Neutral Task81.33Accuracy (%)90.1
Open LLM Leaderboard - MuSR17.16Score87.9
Open Arabic LLM - Arabic MMLU Arabic Language (Grammar)53.15Accuracy (%)84
Open Arabic LLM - Alghafa Multiple Choice Rating Sentiment Task54.51Accuracy (%)81.2
Open Arabic LLM - Madinah QA Arabic Language (Grammar)54.79Accuracy (%)80.6
Open Arabic LLM - Alghafa Multiple Choice Sentiment Task41.22Accuracy (%)77.8
Open LLM Leaderboard - IFEval61.13Score73.2
Open Arabic LLM - Alghafa Meta AR MSA84.13Accuracy (%)71
Open Arabic LLM - Alghafa Multiple Choice Grounded Statement Xglue Mlqa Task88Accuracy (%)69.4
Open Arabic LLM - Arabic MMLU HT Formal Logic46.03Accuracy (%)68.5
Open Arabic LLM - Alghafa Average73.79Accuracy (%)67.9
Open LLM Leaderboard - GPQA7.94Score67

Interactive version: theaggregate.ai/model?slug=sauerkrautlm-nemo-12b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.