Evil-Alpaca-3B-L3.2 — benchmark results

Provider: Other. Released 2024-09-28. Access: Open.

Unified ELO 1362 ± 37, rank #1374 of 1776 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR10.94Score56
Open LLM Leaderboard - MATH Level 57.02Score37.5
UGI - Willingness (W/10)4.5W/10 Score33.7
Open LLM Leaderboard - BBH20.85Score31.2
Open LLM Leaderboard - IFEval32.51Score30.4
Open LLM Leaderboard - MMLU-Pro18.01Score27.5
UGI Leaderboard24.57UGI Score18.7
Open LLM Leaderboard - GPQA1.79Score17.3
UGI - Natural Intelligence9.86NatInt Score6.8
UGI - Writing11.9Writing Score3.3

Interactive version: theaggregate.ai/model?slug=evil-alpaca-3b-l3-2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.