PLLuM-12B-chat — benchmark results

Provider: PLLuM. Released 2025-02-24. Access: Open.

Unified ELO 1294 ± 45, rank #1543 of 1776 rated models, from 25 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR14.67Score79.7
LLMZSZL Leaderboard49.69Score62.2
Polish EQ-Bench57.29EQ-Bench Score59.4
MT-Bench PL - Writing8Judge Score (0-10)55.1
MT-Bench PL - Humanities9.3Judge Score (0-10)52
CPTU Bench3.14Average Score (1-5)42.4
MT-Bench PL - STEM8Judge Score (0-10)36.7
Open LLM Leaderboard - MMLU-Pro20.8Score32.7
Open LLM Leaderboard - BBH21.32Score31.8
MT-Bench PL - Overall5.81Judge Score (0-10)30.6
Open LLM Leaderboard - IFEval32.14Score29.8
MT-Bench PL - Reasoning3.9Judge Score (0-10)28.6

Interactive version: theaggregate.ai/model?slug=pllum-12b-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.