GritLM-7B-KTO — benchmark results

Provider: Other. Released 2024-04-16. Access: Open.

Unified ELO 1357 ± 18, rank #1391 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard314.14Average Score (%)67.9
Open LLM Leaderboard - IFEval53.1Score63.1
Open Chinese LLM - TruthfulQA MC54.48Accuracy (%)57.3
Open LLM Leaderboard - GPQA6.38Score53.5
Open LLM Leaderboard - BBH27.9Score44.9
Open LLM Leaderboard - MuSR6.64Score31.5
Open LLM Leaderboard - MMLU-Pro18.67Score28.4
Open Chinese LLM - ARC Challenge46.84Accuracy (%)25.2
Open LLM Leaderboard - MATH Level 52.72Score17.5
Open Chinese LLM - WinoGrande60.46Accuracy (%)17.2
Open Chinese LLM - GSM8K23.65Accuracy (%)16.9
Open Chinese LLM - C-Eval Semantic53.66Accuracy (%)14.2

Interactive version: theaggregate.ai/model?slug=gritlm-7b-kto · How the rankings work · Data refreshed daily, snapshot 2026-07-22.