Infinity-Instruct-3M-0625-Llama3-8B: benchmark results

BAAI's Llama 3 8B tuned on the Infinity-Instruct 3M foundational set plus the 0625 chat stage, SFT-only with no RLHF. Provider: BAAI. Released 2024-07-09. Access: Open.

Unified ELO 1487 ± 1, rank #746 of 1392 rated models, from 17 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard45.91Average Score (%)92.3
Open Chinese LLM - GSM8K57.62Accuracy (%)80
Open LLM Leaderboard - IFEval60.5Score72.4
BenchBench65.38Aggregate Score (%)69.1
AlpacaEval 2.027.52LC Win Rate (%)64.9
Open Chinese LLM Leaderboard57.75Average Score (%)60.8
Open Chinese LLM - C-Eval Semantic70.97Accuracy (%)54.9
Open Chinese LLM - CMMLU53.81Accuracy (%)51.9
Open LLM Leaderboard - BBH28.99Score48.4
Open Chinese LLM - TruthfulQA MC53.02Accuracy (%)45.1
Open LLM Leaderboard - MMLU-Pro25.02Score44.8
Open LLM Leaderboard - MATH Level 58.84Score43.6

Interactive version: theaggregate.ai/model?slug=infinity-instruct-3m-0625-llama3-8b · How It Works · Data refreshed daily, snapshot 2026-09-05.