AnFeng_v3.1-Avocet: benchmark results

NLPark's sparsely documented 34B conversational model on the Yi-34B architecture, tagged not-for-all-audiences. Provider: Other. Released 2024-08-03. Access: Open.

Unified ELO 1492 ± 1, rank #816 of 1553 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MMLU-Pro38.2Score82.3
Open LLM Leaderboard - MuSR14.98Score81
Open LLM Leaderboard - BBH40.31Score79.4
Open LLM Leaderboard - GPQA9.96Score78
Open LLM Leaderboard - MATH Level 515.94Score63.7
Open LLM Leaderboard - IFEval50.96Score60.8
Open Korean LLM Leaderboard36.8Average Score (%)56

Interactive version: theaggregate.ai/model?slug=anfeng-v3-1-avocet · How It Works · Data refreshed daily, snapshot 2026-09-08.