openbuddy-qwen1.5-32B-v21.2-32k: benchmark results

Provider: Other. Access: Open.

Unified ELO 1504 ± 23, rank #1169 of 2928 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - MMLU73.27Accuracy (%) (5-shot)95.5
Open Portuguese LLM - FaQuAD NLI81.69Macro F1 (%)92.9
Open Portuguese LLM - ENEM75.02Accuracy (%)88.3
Open Portuguese LLM - BLUEX61.34Accuracy (%)80.2
Open Portuguese LLM - OAB Exams51.44Accuracy (%)80
Open Portuguese LLM - ASSIN2 RTE92.21Macro F1 (%)76.2
Open LLM Leaderboard v1 - WinoGrande80.43Accuracy (%) (5-shot)73.8
Open LLM Leaderboard v1 - TruthfulQA MC259.19MC2 (%) (0-shot)73.4
Open LLM Leaderboard v1 - ARC Challenge64.51Normalized accuracy (%) (25-shot)66.9
Open LLM Leaderboard v1 - HellaSwag83.23Normalized accuracy (%) (10-shot)57
Open LLM Leaderboard v1 - GSM8K15.47Accuracy (%) (5-shot)37.4

Interactive version: theaggregate.ai/model?slug=openbuddy-qwen1-5-32b-v21-2-32k · How It Works · Data refreshed daily, snapshot 2026-09-23.