mistral-orpo-capybara-7k — benchmark results

Provider: Mistral. Released 2024-03-23. Access: Open.

Unified ELO 1351 ± 18, rank #1409 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval53.67Score64.2
Open LLM Leaderboard - GPQA4.81Score41
Open Korean LLM Leaderboard34.35Average Score (%)35.7
Open LLM Leaderboard - MMLU-Pro21.9Score35.5
Open LLM Leaderboard - MuSR7.58Score35.4
Open LLM Leaderboard - BBH23.43Score35.3
Open Chinese LLM - TruthfulQA MC51.8Accuracy (%)32.3
Open Chinese LLM - ARC Challenge47.78Accuracy (%)31.6
Open Chinese LLM - HellaSwag55.9Accuracy (%)28
Open Chinese LLM - CMMLU47.89Accuracy (%)27.9
Open LLM Leaderboard - MATH Level 53.93Score22.6
Open Chinese LLM - GSM8K27.9Accuracy (%)20.8

Interactive version: theaggregate.ai/model?slug=mistral-orpo-capybara-7k · How the rankings work · Data refreshed daily, snapshot 2026-07-22.