speechless-zephyr-code-functionary-7B — benchmark results

Provider: Other. Released 2024-01-23. Access: Open.

Unified ELO 1359 ± 19, rank #1387 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR11.61Score61.9
Open LLM Leaderboard - GPQA6.71Score56.5
Open LLM Leaderboard - BBH25.98Score40.2
Open LLM Leaderboard - MMLU-Pro23.27Score39.7
Open Chinese LLM - CMMLU48.74Accuracy (%)30
Open LLM Leaderboard - MATH Level 54.23Score24.2
Open LLM Leaderboard - IFEval26.96Score24
Open Chinese LLM - WinoGrande61.01Accuracy (%)21.8
Open Chinese LLM - GSM8K27.67Accuracy (%)20.5
Open Chinese LLM - HellaSwag54.25Accuracy (%)19.9
Open Chinese LLM - TruthfulQA MC50.06Accuracy (%)19.3
Open Chinese LLM - ARC Challenge45.9Accuracy (%)18.7

Interactive version: theaggregate.ai/model?slug=speechless-zephyr-code-functionary-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.