Bielik-7B-Instruct-v0.1: benchmark results

Provider: SpeakLeash. Access: Open.

Unified ELO 1424 ± 16, rank #1708 of 2656 rated models, from 100 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open PL LLM - PolQA Closed Book (generative, 5-shot)69.78Levenshtein Similarity (%)77
Open PL LLM - PolQA Open Book (generative, 5-shot)86Levenshtein Similarity (%)75.1
Open PL LLM - CBD (multiple choice, 5-shot)29.4Macro F1 (%)68.7
Open PL LLM - CBD (generative, 5-shot)30.69Macro F1 (%)68.6
MT-Bench PL - Reasoning6.15Judge Score (0-10)62.2
Open PL LLM - PSC (multiple choice, 5-shot)70.3Binary F1 (%)61.1
Open PL LLM - 8TAGS (generative, 5-shot)73.22Accuracy (%)56.6
Open PL LLM - Multiple Choice42.52Average Multiple-Choice Score (%)55.2
Open PL LLM - DYK (multiple choice, 5-shot)51.55Binary F1 (%)55.1
Open PL LLM - DYK (generative, 5-shot)52.7Binary F1 (%)54.1
Open PL LLM - Generative50.19Average Generative Score (%)53.5
Open PL LLM Leaderboard44.7Average Score (%)51.7

Interactive version: theaggregate.ai/model?slug=bielik-7b-instruct-v0-1 · How It Works · Data refreshed daily, snapshot 2026-09-19.