Mistral Medium 3.1 — benchmark results

Mistral's Medium 3.1 frontier multimodal model (August 2025). Provider: Mistral. Released 2025-08-13. Access: API.

Unified ELO 1625 ± 11, rank #423 of 1776 rated models, from 404 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AGC-Bench - cpers1.65Dataset z-score100
AGC-Bench - mops2.56Dataset z-score100
AGC-Bench - story_quality1.38Dataset z-score100
AGC-Bench - pun_eval1.42Dataset z-score98.8
AGC-Bench - tinyfabulist1.83Dataset z-score98.8
AGC-Bench - thenextchapter2.08Dataset z-score97.6
AGC-Bench - tinystories1.6Dataset z-score96.3
AGC-Bench - unfun_corpus1.03Dataset z-score96.2
Galileo Agent - Insurance Accuracy70Accuracy (%)95.2
Galileo Agent - Investment Accuracy57Accuracy (%)95.2
Galileo Agent - Telecom Accuracy59Accuracy (%)95.2
Galileo Agent Leaderboard61Avg Accuracy (%)95.2

Interactive version: theaggregate.ai/model?slug=mistral-medium-3-1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.