Mistral7B-PairRM-SPPO-Iter1 — benchmark results

Provider: Mistral. Released 2024-05-04. Access: Open.

Unified ELO 1361 ± 34, rank #1379 of 1776 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard311.79Average Score (%)67.2
Open LLM Leaderboard - IFEval50.47Score59.8
Open LLM Leaderboard - MuSR8.3Score39.3
Open LLM Leaderboard - GPQA4.47Score38.5
Open LLM Leaderboard - BBH22.93Score34.6
Open LLM Leaderboard - MMLU-Pro18.84Score28.6
Open LLM Leaderboard - MATH Level 52.49Score16.3

Interactive version: theaggregate.ai/model?slug=mistral7b-pairrm-sppo-iter1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.