AnFeng_v3.1-Avocet — benchmark results

NLPark's sparsely documented 34B conversational model on the Yi-34B architecture, tagged not-for-all-audiences. Provider: Other. Released 2024-08-03. Access: Open.

Unified ELO 1464 ± 31, rank #941 of 1776 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MMLU-Pro38.2Score82.3
Open LLM Leaderboard - MuSR14.98Score81
Open LLM Leaderboard - BBH40.31Score79.4
Open LLM Leaderboard - GPQA9.96Score78
Open Korean LLM Leaderboard349.23Average Score (%)70.9
Open LLM Leaderboard - MATH Level 515.94Score63.7
Open LLM Leaderboard - IFEval50.96Score60.8

Interactive version: theaggregate.ai/model?slug=anfeng-v3-1-avocet · How the rankings work · Data refreshed daily, snapshot 2026-07-22.