Infinity-Instruct-3M-0625-Yi-1.5-9B — benchmark results
BAAI's SFT-only fine-tune of Yi-1.5 9B, trained in two stages on the Infinity-Instruct 3M and 0625 datasets without RLHF (July 2024). Provider: BAAI. Released 2024-07-09. Access: Open.
Unified ELO 1450 ± 28, rank #1001 of 1776 rated models, from 16 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - GPQA | 13.87 | Score | 89.1 |
| Open Chinese LLM - GSM8K | 62.02 | Accuracy (%) | 86.9 |
| Open LLM Leaderboard - MuSR | 16.72 | Score | 86.5 |
| Open Chinese LLM Leaderboard | 64.37 | Average Score (%) | 78.9 |
| Open Chinese LLM - C-Eval Semantic | 86.01 | Accuracy (%) | 78 |
| Open Chinese LLM - HellaSwag | 64.06 | Accuracy (%) | 75.4 |
| Open LLM Leaderboard - MMLU-Pro | 34.65 | Score | 74.9 |
| Open Chinese LLM - WinoGrande | 65.59 | Accuracy (%) | 73.3 |
| Open Chinese LLM - CMMLU | 63.12 | Accuracy (%) | 73.1 |
| Open Chinese LLM - ARC Challenge | 56.66 | Accuracy (%) | 72.8 |
| Open LLM Leaderboard - BBH | 35.38 | Score | 71.5 |
| Open LLM Leaderboard - MATH Level 5 | 16.39 | Score | 64.5 |
Interactive version: theaggregate.ai/model?slug=infinity-instruct-3m-0625-yi-1-5-9b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.