MSH-v1-Bielik-v2.3-Instruct-MedIT-merge — benchmark results
MedIT Solutions' Polish-language merge of SpeakLeash's Bielik 11B v2.3 Instruct with Bielik 11B v2 using its proprietary checkpoint-merging method. Provider: Other. Released 2024-10-29. Access: Open.
Unified ELO 1531 ± 22, rank #684 of 1776 rated models, from 10 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open PL LLM - RAG | 75.62 | Average RAG Score (%) | 96.9 |
| Open PL LLM - Multiple Choice | 63.39 | Average Multiple-Choice Score (%) | 95.8 |
| Open PL LLM Leaderboard | 65.8 | Average Score (%) | 94.8 |
| Open PL LLM - Generative | 67.66 | Average Generative Score (%) | 90 |
| Open LLM Leaderboard - GPQA | 12.75 | Score | 86.3 |
| Open LLM Leaderboard - BBH | 38.02 | Score | 77.9 |
| Open LLM Leaderboard - MuSR | 13.84 | Score | 76.2 |
| Open LLM Leaderboard - MATH Level 5 | 20.77 | Score | 72.2 |
| Open LLM Leaderboard - IFEval | 58.14 | Score | 70 |
| Open LLM Leaderboard - MMLU-Pro | 27.78 | Score | 51.4 |
Interactive version: theaggregate.ai/model?slug=msh-v1-bielik-v2-3-instruct-medit-merge · How the rankings work · Data refreshed daily, snapshot 2026-07-22.