Infinity-Instruct-3M-0625-Llama3-8B — benchmark results

BAAI's Llama 3 8B tuned on the Infinity-Instruct 3M foundational set plus the 0625 chat stage, SFT-only with no RLHF. Provider: BAAI. Released 2024-07-09. Access: Open.

Unified ELO 1419 ± 17, rank #1137 of 1776 rated models, from 17 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard499.9Average Score (%)87.5
Open Chinese LLM - GSM8K57.62Accuracy (%)80
Open LLM Leaderboard - IFEval60.5Score72.4
BenchBench65.38Aggregate Score (%)69.1
AlpacaEval 2.027.52LC Win Rate (%)64.9
Open Chinese LLM Leaderboard57.75Average Score (%)60.8
Open Chinese LLM - C-Eval Semantic70.97Accuracy (%)54.9
Open Chinese LLM - CMMLU53.81Accuracy (%)51.9
Open LLM Leaderboard - BBH28.99Score48.4
Open Chinese LLM - TruthfulQA MC53.02Accuracy (%)45.1
Open LLM Leaderboard - MMLU-Pro25.02Score44.8
Open LLM Leaderboard - MATH Level 58.84Score43.7

Interactive version: theaggregate.ai/model?slug=infinity-instruct-3m-0625-llama3-8b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.