CodeNinja-1.0-OpenChat-7B — benchmark results

Provider: Other. Released 2023-12-20. Access: Open.

Unified ELO 1375 ± 15, rank #1326 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval54.47Score65.6
Open Korean LLM Leaderboard272.61Average Score (%)65
Open LLM Leaderboard - MuSR11.54Score61.3
Open LLM Leaderboard - GPQA5.93Score49.7
Open Chinese LLM - TruthfulQA MC52.75Accuracy (%)39.8
Open LLM Leaderboard - MMLU-Pro22.39Score36.9
Open LLM Leaderboard - MATH Level 56.72Score36.4
Open LLM Leaderboard - BBH21.71Score32.4
Open Chinese LLM - GSM8K35.48Accuracy (%)31.3
Open Chinese LLM - CMMLU45.88Accuracy (%)14.8
Open Chinese LLM Leaderboard48.7Average Score (%)14.8
Open Chinese LLM - ARC Challenge44.28Accuracy (%)14.1

Interactive version: theaggregate.ai/model?slug=codeninja-1-0-openchat-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.