openchat-3.5-0106: benchmark results

Provider: Other. Released 2024-01-06. Access: Open.

Unified ELO 1467 ± 1, rank #859 of 1392 rated models, from 60 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard40.77Average Score (%)75.9
Open CoT - LSAT Logical Reasoning14.9CoT Gain (%)71.8
Open LLM Leaderboard - IFEval59.67Score71.6
Open PL LLM Leaderboard55.51Average Score (%)69.9
Open PL LLM - RAG66.49Average RAG Score (%)69.6
Open PL LLM - Generative59Average Generative Score (%)69.2
Open PL LLM - Multiple Choice50.97Average Multiple-Choice Score (%)68.5
BiGGen-Bench3.58Average Score (1-5)66.7
Open CoT - LogiQA 29.61CoT Gain (%)65.6
Open LLM Leaderboard - GPQA7.72Score65.2
LogicKor - Coding8Score (0-10)63.4
Open CoT - LSAT Analytical Reasoning4.78CoT Gain (%)63

Interactive version: theaggregate.ai/model?slug=openchat-3-5-0106 · How It Works · Data refreshed daily, snapshot 2026-09-05.