GritLM-7B-KTO: benchmark results

Provider: Other. Released 2024-04-16. Access: Open.

Unified ELO 1393 ± 1, rank #1168 of 1392 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval53.1Score63.1
Open Chinese LLM - TruthfulQA MC54.48Accuracy (%)57.3
Open Korean LLM Leaderboard36.52Average Score (%)54.6
Open LLM Leaderboard - GPQA6.38Score53.5
Open LLM Leaderboard - BBH27.9Score44.9
Open LLM Leaderboard - MuSR6.64Score31.5
Open LLM Leaderboard - MMLU-Pro18.67Score28.4
Open Chinese LLM - ARC Challenge46.84Accuracy (%)25.2
Open LLM Leaderboard - MATH Level 52.72Score17.5
Open Chinese LLM - WinoGrande60.46Accuracy (%)17.2
Open Chinese LLM - GSM8K23.65Accuracy (%)16.9
Open Chinese LLM - C-Eval Semantic53.66Accuracy (%)14.2

Interactive version: theaggregate.ai/model?slug=gritlm-7b-kto · How It Works · Data refreshed daily, snapshot 2026-09-05.