janus-orpo-7B — benchmark results

Provider: KAIST. Released 2024-04-18. Access: Open.

Unified ELO 1348 ± 11, rank #1425 of 1776 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard332.97Average Score (%)69.1
Open Chinese LLM - WinoGrande61.88Accuracy (%)32.9
Open Chinese LLM - TruthfulQA MC51.73Accuracy (%)31
Open Chinese LLM - GSM8K27.37Accuracy (%)19.7
Open Chinese LLM - ARC Challenge45.14Accuracy (%)16
Open Chinese LLM - CMMLU45.01Accuracy (%)12.8
Open Chinese LLM Leaderboard47.85Average Score (%)12.5
Open Chinese LLM - HellaSwag52.63Accuracy (%)11.6
Open Chinese LLM - C-Eval Semantic51.2Accuracy (%)10.7

Interactive version: theaggregate.ai/model?slug=janus-orpo-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.