openbuddy-qwen1.5-32B-v21.1-32k: benchmark results

Provider: Other. Access: Open.

Unified ELO 1523 ± 21, rank #1027 of 2928 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - MMLU73.76Accuracy (%) (5-shot)95.7
Open Portuguese LLM - FaQuAD NLI78.04Macro F1 (%)82.4
Open Portuguese LLM - OAB Exams52.53Accuracy (%)81.9
Open LLM Leaderboard v1 - GSM8K65.66Accuracy (%) (5-shot)80.4
Open LLM Leaderboard v1 - WinoGrande80.43Accuracy (%) (5-shot)73.8
Open LLM Leaderboard v1 - ARC Challenge65.36Normalized accuracy (%) (25-shot)69.8
Open LLM Leaderboard v1 - TruthfulQA MC256.12MC2 (%) (0-shot)67.1
Open Portuguese LLM - BLUEX56.75Accuracy (%)67
Open Portuguese LLM - ASSIN2 RTE91.34Macro F1 (%)66.5
Open LLM Leaderboard v1 - HellaSwag83.16Normalized accuracy (%) (10-shot)56.5
Open Portuguese LLM - ENEM62.63Accuracy (%)52.6

Interactive version: theaggregate.ai/model?slug=openbuddy-qwen1-5-32b-v21-1-32k · How It Works · Data refreshed daily, snapshot 2026-09-23.