Chocolatine-14B-Instruct-4k-DPO — benchmark results

jpacifico's French-English DPO fine-tune of Phi-3-medium with a 4k context window, sibling of the 128k Chocolatine v1.2. Provider: Other. Released 2024-08-01. Access: Open.

Unified ELO 1505 ± 28, rank #781 of 1776 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard584.02Average Score (%)93.2
Open LLM Leaderboard - BBH48.02Score88
Open LLM Leaderboard - MMLU-Pro41.82Score86.4
Open LLM Leaderboard - GPQA12.19Score84.9
Open LLM Leaderboard - MuSR15.15Score81.5
Open LLM Leaderboard - MATH Level 517.82Score67.1
Open LLM Leaderboard - IFEval46.89Score53.7

Interactive version: theaggregate.ai/model?slug=chocolatine-14b-instruct-4k-dpo · How the rankings work · Data refreshed daily, snapshot 2026-07-22.