franqwenstein-35B: benchmark results
Provider: Other. Released 2024-10-03. Access: Open.
Unified ELO 1687 ± 57, rank #352 of 2656 rated models, from 11 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - GPQA | 40.35 | Score | 99.3 |
| Open LLM Leaderboard - MMLU-Pro | 57.31 | Score | 99.2 |
| Open Portuguese LLM - FaQuAD NLI | 86.2 | Macro F1 (%) | 99.2 |
| Open LLM Leaderboard - MuSR | 49.4 | Score | 97.6 |
| Open Portuguese LLM - ASSIN2 RTE | 94.44 | Macro F1 (%) | 96.5 |
| Open Portuguese LLM - BLUEX | 74.83 | Accuracy (%) | 95.4 |
| Open Portuguese LLM - ENEM | 82.02 | Accuracy (%) | 95.3 |
| Open LLM Leaderboard - BBH | 66.47 | Score | 94.6 |
| Open Portuguese LLM - OAB Exams | 59.18 | Accuracy (%) | 91.9 |
| Open LLM Leaderboard - MATH Level 5 | 34.06 | Score | 84.7 |
| Open LLM Leaderboard - IFEval | 39.14 | Score | 38.8 |
Interactive version: theaggregate.ai/model?slug=franqwenstein-35b · How It Works · Data refreshed daily, snapshot 2026-09-19.