PLLuM-12B-nc-chat — benchmark results
Provider: PLLuM. Released 2025-02-24. Access: Open.
Unified ELO 1316 ± 56, rank #1501 of 1776 rated models, from 21 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - MuSR | 12.92 | Score | 70.9 |
| LLMZSZL Leaderboard | 53.4 | Score | 69.4 |
| MT-Bench PL - Humanities | 9.5 | Judge Score (0-10) | 67.3 |
| MT-Bench PL - STEM | 9.1 | Judge Score (0-10) | 63.3 |
| MT-Bench PL - Overall | 6.47 | Judge Score (0-10) | 46.9 |
| CPTU Bench | 3.15 | Average Score (1-5) | 44 |
| MT-Bench PL - Writing | 7.55 | Judge Score (0-10) | 39.8 |
| Open LLM Leaderboard - GPQA | 4.36 | Score | 37.6 |
| MT-Bench PL - Coding | 4.55 | Judge Score (0-10) | 35.7 |
| MT-Bench PL - Roleplay | 6.75 | Judge Score (0-10) | 35.7 |
| Open LLM Leaderboard - BBH | 23.01 | Score | 34.8 |
| MT-Bench PL - Extraction | 7.2 | Judge Score (0-10) | 34.7 |
Interactive version: theaggregate.ai/model?slug=pllum-12b-nc-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.