Minueza-32M-UltraChat: benchmark results

Provider: Other. Access: Open.

Unified ELO 1206 ± 20, rank #2894 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - TruthfulQA MC247.7MC2 (%) (0-shot)38.4
Open LLM Leaderboard - MuSR37.42Score26.3
Open LLM Leaderboard v1 - MMLU26.08Accuracy (%) (5-shot)11.3
Open LLM Leaderboard v1 - GSM8K0.23Accuracy (%) (5-shot)10.8
Open LLM Leaderboard - GPQA25.59Score8.4
Open LLM Leaderboard v1 - WinoGrande51.78Accuracy (%) (5-shot)6.1
Open LLM Leaderboard - MMLU-Pro11.33Score5
Open LLM Leaderboard - MATH Level 50.45Score4.3
Open LLM Leaderboard - IFEval13.76Score3.8
Open LLM Leaderboard v1 - HellaSwag26.95Normalized accuracy (%) (10-shot)3.8
Open LLM Leaderboard - BBH29.41Score3.1
Open LLM Leaderboard v1 - ARC Challenge21.08Normalized accuracy (%) (25-shot)0.3

Interactive version: theaggregate.ai/model?slug=minueza-32m-ultrachat · How It Works · Data refreshed daily, snapshot 2026-09-23.