pixtral-large-2411 — benchmark results

Provider: Mistral. Released 2024-11-18. Access: Open.

Unified ELO 1522 ± 21, rank #743 of 1841 rated models, from 78 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AGC-Bench - proparalogy0.87Dataset z-score95.1
AGC-Bench - simile_generation0.92Dataset z-score87.5
TextClass Benchmark1697.33Meta-Elo (self-reported)86
AGC-Bench - analobench0.77Dataset z-score85.2
AGC-Bench - creatset1.18Dataset z-score82.9
AGC-Bench - permpst0.81Dataset z-score81.7
AGC-Bench - metaphor_generation0.69Dataset z-score78
AGC-Bench - c3_crosstalk0.81Dataset z-score76.8
AGC-Bench - grapheval_review_advisor0.61Dataset z-score75.6
AGC-Bench - science_analogies0.49Dataset z-score73.8
AGC-Bench - outline_to_story0.58Dataset z-score72.8
AGC-Bench - sdat0.43Dataset z-score72.8

Interactive version: theaggregate.ai/model?slug=pixtral-large-2411 · How It Works · Data refreshed daily, snapshot 2026-07-25.