PLLuM-12B-nc-chat — benchmark results

Provider: PLLuM. Released 2025-02-24. Access: Open.

Unified ELO 1316 ± 56, rank #1501 of 1776 rated models, from 21 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR12.92Score70.9
LLMZSZL Leaderboard53.4Score69.4
MT-Bench PL - Humanities9.5Judge Score (0-10)67.3
MT-Bench PL - STEM9.1Judge Score (0-10)63.3
MT-Bench PL - Overall6.47Judge Score (0-10)46.9
CPTU Bench3.15Average Score (1-5)44
MT-Bench PL - Writing7.55Judge Score (0-10)39.8
Open LLM Leaderboard - GPQA4.36Score37.6
MT-Bench PL - Coding4.55Judge Score (0-10)35.7
MT-Bench PL - Roleplay6.75Judge Score (0-10)35.7
Open LLM Leaderboard - BBH23.01Score34.8
MT-Bench PL - Extraction7.2Judge Score (0-10)34.7

Interactive version: theaggregate.ai/model?slug=pllum-12b-nc-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.