Yi-6B-Infinity-Chat: benchmark results

Provider: 01.AI. Access: Open.

Unified ELO 1331 ± 17, rank #2343 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-EQ-Bench3.17EQ-Bench score49.3
Open Korean LLM - Ko-GSM8K (flexible extract)6.52Exact match, flexible extract (%)28.1
Open Korean LLM - KorNAT-Harmless61.38Normalized accuracy (%)27.6
Open Korean LLM - Ko-IFEval21.61Strict accuracy, prompt/instruction mean (%)21.8
Open Korean LLM - KorNAT-Helpful42.98Normalized accuracy (%)20.2
Open Korean LLM - Ko-GPQA-Diamond20.2Normalized accuracy (%)13.9
Open Korean LLM - Ko-Winogrande53.67Accuracy (%)13.3
Open Korean LLM Leaderboard29.7Average Score (%)13
Open Ko-LLM Leaderboard29.7Average (%)12.9
Open Korean LLM - KorNAT-CKA12.47Normalized accuracy (%)3.4

Interactive version: theaggregate.ai/model?slug=yi-6b-infinity-chat · How It Works · Data refreshed daily, snapshot 2026-09-19.