franqwenstein-35B: benchmark results

Provider: Other. Released 2024-10-03. Access: Open.

Unified ELO 1687 ± 57, rank #352 of 2656 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - GPQA40.35Score99.3
Open LLM Leaderboard - MMLU-Pro57.31Score99.2
Open Portuguese LLM - FaQuAD NLI86.2Macro F1 (%)99.2
Open LLM Leaderboard - MuSR49.4Score97.6
Open Portuguese LLM - ASSIN2 RTE94.44Macro F1 (%)96.5
Open Portuguese LLM - BLUEX74.83Accuracy (%)95.4
Open Portuguese LLM - ENEM82.02Accuracy (%)95.3
Open LLM Leaderboard - BBH66.47Score94.6
Open Portuguese LLM - OAB Exams59.18Accuracy (%)91.9
Open LLM Leaderboard - MATH Level 534.06Score84.7
Open LLM Leaderboard - IFEval39.14Score38.8

Interactive version: theaggregate.ai/model?slug=franqwenstein-35b · How It Works · Data refreshed daily, snapshot 2026-09-19.