janus-dpo-7B — benchmark results

Provider: KAIST. Released 2024-04-25. Access: Open.

Unified ELO 1371 ± 15, rank #1340 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR13.71Score75.4
Open Chinese LLM - TruthfulQA MC52.92Accuracy (%)43.9
Open LLM Leaderboard - BBH27.09Score42.9
Open LLM Leaderboard - IFEval40.03Score39.9
Open LLM Leaderboard - GPQA4.25Score36.8
Open LLM Leaderboard - MMLU-Pro21.96Score35.6
Open Chinese LLM - GSM8K31.77Accuracy (%)26.4
Open Chinese LLM - CMMLU47.35Accuracy (%)25.5
Open Chinese LLM - HellaSwag55.16Accuracy (%)25.2
Open Chinese LLM - ARC Challenge46.67Accuracy (%)24
Open LLM Leaderboard - MATH Level 54.15Score23.9
Open Chinese LLM - WinoGrande61.01Accuracy (%)21.8

Interactive version: theaggregate.ai/model?slug=janus-dpo-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.