openchat-3.5-0106 — benchmark results

Provider: Other. Released 2024-01-06. Access: Open.

Unified ELO 1381 ± 11, rank #1307 of 1776 rated models, from 48 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard474.25Average Score (%)84.7
Open CoT - LSAT Logical Reasoning14.9CoT Gain (%)71.8
Open LLM Leaderboard - IFEval59.67Score71.6
Open PL LLM Leaderboard55.51Average Score (%)69.9
Open PL LLM - RAG66.49Average RAG Score (%)69.6
Open PL LLM - Generative59Average Generative Score (%)69.2
Open PL LLM - Multiple Choice50.97Average Multiple-Choice Score (%)68.5
LogicKor - Coding8Score (0-10)66.8
BiGGen-Bench3.58Average Score (1-5)66.7
Open CoT - LogiQA 29.61CoT Gain (%)65.6
Open LLM Leaderboard - GPQA7.72Score65.2
Open CoT - LSAT Analytical Reasoning4.78CoT Gain (%)63

Interactive version: theaggregate.ai/model?slug=openchat-3-5-0106 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.