L3-70B-Euryale-v2.1: benchmark results

Sao10K's community roleplay and creative-writing fine-tune of Llama 3 70B. Provider: Other. Released 2024-06-11. Access: Open.

Unified ELO 1596 ± 1, rank #275 of 1392 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - BBH49.19Score89.9
Open LLM Leaderboard - IFEval73.84Score88.6
Open LLM Leaderboard - MMLU-Pro45.6Score88.5
UGI Leaderboard49.34UGI Score88.5
Open LLM Leaderboard - GPQA10.85Score81
UGI - Willingness (W/10)7.5W/10 Score77.9
Open LLM Leaderboard - MATH Level 522.43Score75.5
UGI - Natural Intelligence27.62NatInt Score68
Open LLM Leaderboard - MuSR12.25Score66.7
UGI - Writing37.64Writing Score64.6

Interactive version: theaggregate.ai/model?slug=l3-70b-euryale-v2-1 · How It Works · Data refreshed daily, snapshot 2026-09-05.