Bielik-11B-v2 — benchmark results

Provider: SpeakLeash. Released 2024-08-26. Access: Open.

Unified ELO 1379 ± 11, rank #1317 of 1776 rated models, from 137 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Arabic LLM - Aratrust Offensive92.75Accuracy (%)88.2
Open PL LLM - RAG69.34Average RAG Score (%)77.3
Open PL LLM - Generative61.57Average Generative Score (%)74.1
Open PL LLM Leaderboard58.14Average Score (%)74.1
Open PL LLM - Multiple Choice53.68Average Multiple-Choice Score (%)73.4
LLMZSZL Leaderboard55.14Score72.4
Open LLM Leaderboard - BBH27.82Score44.6
Open LLM Leaderboard - GPQA5.15Score43.2
Open LLM Leaderboard - MMLU-Pro23.75Score41.5
Open Arabic LLM - Arabic MMLU Accounting (University)47.3Accuracy (%)41.4
Open Arabic LLM - Alghafa Multiple Choice Grounded Statement Soqal Task72.67Accuracy (%)40.7
Open LLM Leaderboard - MATH Level 57.85Score40.4

Interactive version: theaggregate.ai/model?slug=bielik-11b-v2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.