luxia-21.4B-alignment-v1.0 — benchmark results

Korean firm Saltlux's 21.4B SFT+DPO alignment model built on a Luxia base depth-upscaled from internlm2-20b with continual pretraining (March 2024). Provider: Other. Released 2024-03-12. Access: Open.

Unified ELO 1487 ± 20, rank #853 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - HellaSwag80.26Accuracy (%)100
Open Chinese LLM - TruthfulQA MC70.67Accuracy (%)100
Open Chinese LLM - WinoGrande74.35Accuracy (%)100
Open Chinese LLM - ARC Challenge69.97Accuracy (%)99.1
Open Chinese LLM Leaderboard71.65Average Score (%)97.6
Open LLM Leaderboard - BBH48.02Score88
Open Chinese LLM - GSM8K61.18Accuracy (%)85.8
Open Korean LLM Leaderboard465.13Average Score (%)83.9
Open Chinese LLM - C-Eval Semantic84.61Accuracy (%)76.3
Open Chinese LLM - CMMLU60.5Accuracy (%)69.4
Open LLM Leaderboard - MuSR12.51Score68.4
Open LLM Leaderboard - GPQA6.82Score57.4

Interactive version: theaggregate.ai/model?slug=luxia-21-4b-alignment-v1-0 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.