Fireball-Alpaca-Llama3.1.08-8B-Philos-C-R2: benchmark results

Provider: Other. Access: Open.

Unified ELO 1487 ± 58, rank #1201 of 2656 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR46.24Score88.7
Open Portuguese LLM - ENEM66.76Accuracy (%)64.6
Open Portuguese LLM - OAB Exams46.15Accuracy (%)63.1
Open LLM Leaderboard - MATH Level 512.39Score55.5
Open Portuguese LLM - BLUEX53.27Accuracy (%)55.4
Open LLM Leaderboard - IFEval46.73Score53.3
Open LLM Leaderboard - MMLU-Pro33.52Score47.6
Open LLM Leaderboard - BBH49.32Score45.7
Open Portuguese LLM - ASSIN2 RTE88.26Macro F1 (%)44
Open LLM Leaderboard - GPQA28.61Score41
Open Portuguese LLM - FaQuAD NLI39.15Macro F1 (%)6.9

Interactive version: theaggregate.ai/model?slug=fireball-alpaca-llama3-1-08-8b-philos-c-r2 · How It Works · Data refreshed daily, snapshot 2026-09-19.