Chocolatine-14B-Instruct-DPO-v1.2 — benchmark results

jpacifico's French-focused DPO fine-tune of Microsoft's Phi-3-medium-4k-instruct, trained on a revised French Orca DPO pairs dataset. Provider: Other. Released 2024-08-12. Access: Open.

Unified ELO 1525 ± 16, rank #705 of 1776 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard577.95Average Score (%)92.6
Open LLM Leaderboard - BBH49.85Score91.3
Open LLM Leaderboard - MMLU-Pro41.07Score85.9
Open LLM Leaderboard - IFEval68.52Score81.2
Open LLM Leaderboard - GPQA10.07Score78.5
Open LLM Leaderboard - MATH Level 520.92Score72.4
Open LLM Leaderboard - MuSR12.35Score67.5

Interactive version: theaggregate.ai/model?slug=chocolatine-14b-instruct-dpo-v1-2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.