CollectiveCognition-v1.1-Mistral-7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1450 ± 19, rank #1731 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - TruthfulQA MC257.62MC2 (%) (0-shot)70.5
Open LLM Leaderboard v1 - HellaSwag84.17Normalized accuracy (%) (10-shot)64.2
Open LLM Leaderboard v1 - ARC Challenge62.12Normalized accuracy (%) (25-shot)56.1
Open LLM Leaderboard v1 - MMLU62.35Accuracy (%) (5-shot)55.1
Open LLM Leaderboard v1 - GSM8K35.86Accuracy (%) (5-shot)51.4
Open LLM Leaderboard v1 - WinoGrande75.37Accuracy (%) (5-shot)41.9
Open LLM Leaderboard - GPQA28.69Score41.8
Open LLM Leaderboard - BBH44.93Score33.7
Open LLM Leaderboard - MuSR38.69Score33.2
Open LLM Leaderboard - MMLU-Pro28.37Score31.9
Open LLM Leaderboard - IFEval27.9Score25
Open LLM Leaderboard - MATH Level 53.1Score19.4

Interactive version: theaggregate.ai/model?slug=collectivecognition-v1-1-mistral-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.