janus-7B — benchmark results

Provider: KAIST. Released 2024-04-04. Access: Open.

Unified ELO 1361 ± 16, rank #1376 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR14.28Score78.1
Open Chinese LLM - TruthfulQA MC53.25Accuracy (%)46.9
Open LLM Leaderboard - BBH25.75Score39.7
Open LLM Leaderboard - IFEval37.75Score36.8
Open LLM Leaderboard - MMLU-Pro20.82Score32.7
Open LLM Leaderboard - GPQA3.02Score27.6
Open Chinese LLM - GSM8K31.46Accuracy (%)25.1
Open LLM Leaderboard - MATH Level 54.08Score23.5
Open Chinese LLM - ARC Challenge46.16Accuracy (%)20.5
Open Chinese LLM - HellaSwag54.27Accuracy (%)20.2
Open Chinese LLM Leaderboard49.48Average Score (%)18.4
Open Chinese LLM - WinoGrande60.38Accuracy (%)16.3

Interactive version: theaggregate.ai/model?slug=janus-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.