Infinity-Instruct-3M-0625-Yi-1.5-9B — benchmark results

BAAI's SFT-only fine-tune of Yi-1.5 9B, trained in two stages on the Infinity-Instruct 3M and 0625 datasets without RLHF (July 2024). Provider: BAAI. Released 2024-07-09. Access: Open.

Unified ELO 1450 ± 28, rank #1001 of 1776 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - GPQA13.87Score89.1
Open Chinese LLM - GSM8K62.02Accuracy (%)86.9
Open LLM Leaderboard - MuSR16.72Score86.5
Open Chinese LLM Leaderboard64.37Average Score (%)78.9
Open Chinese LLM - C-Eval Semantic86.01Accuracy (%)78
Open Chinese LLM - HellaSwag64.06Accuracy (%)75.4
Open LLM Leaderboard - MMLU-Pro34.65Score74.9
Open Chinese LLM - WinoGrande65.59Accuracy (%)73.3
Open Chinese LLM - CMMLU63.12Accuracy (%)73.1
Open Chinese LLM - ARC Challenge56.66Accuracy (%)72.8
Open LLM Leaderboard - BBH35.38Score71.5
Open LLM Leaderboard - MATH Level 516.39Score64.5

Interactive version: theaggregate.ai/model?slug=infinity-instruct-3m-0625-yi-1-5-9b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.