janus-dpo-7B: benchmark results

Provider: KAIST. Released 2024-04-25. Access: Open.

Unified ELO 1408 ± 1, rank #1104 of 1392 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR13.71Score75.4
Open Chinese LLM - TruthfulQA MC52.92Accuracy (%)43.9
Open LLM Leaderboard - BBH27.09Score42.9
Open LLM Leaderboard - IFEval40.03Score39.9
Open LLM Leaderboard - GPQA4.25Score36.8
Open LLM Leaderboard - MMLU-Pro21.96Score35.6
Open Chinese LLM - GSM8K31.77Accuracy (%)26.4
Open Chinese LLM - CMMLU47.35Accuracy (%)25.5
Open Chinese LLM - HellaSwag55.16Accuracy (%)25.2
Open Chinese LLM - ARC Challenge46.67Accuracy (%)24
Open LLM Leaderboard - MATH Level 54.15Score23.9
Open Chinese LLM - WinoGrande61.01Accuracy (%)21.8

Interactive version: theaggregate.ai/model?slug=janus-dpo-7b · How It Works · Data refreshed daily, snapshot 2026-09-05.