Chocolatine-14B-Instruct-4k-DPO: benchmark results

jpacifico's French-English DPO fine-tune of Phi-3-medium with a 4k context window, sibling of the 128k Chocolatine v1.2. Provider: Other. Released 2024-08-01. Access: Open.

Unified ELO 1519 ± 1, rank #661 of 1553 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - BBH48.02Score88
Open LLM Leaderboard - MMLU-Pro41.82Score86.4
Open LLM Leaderboard - GPQA12.19Score84.9
Open LLM Leaderboard - MuSR15.15Score81.5
Open LLM Leaderboard - MATH Level 517.82Score67.1
Open Korean LLM Leaderboard38.52Average Score (%)64.3
Open LLM Leaderboard - IFEval46.89Score53.7

Interactive version: theaggregate.ai/model?slug=chocolatine-14b-instruct-4k-dpo · How It Works · Data refreshed daily, snapshot 2026-09-08.