llm-jp-3-1.8B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1288 ± 31, rank #2486 of 2656 rated models, from 76 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Japanese LLM - AIO Char F162.17Score (%)77.2
pfgen-bench - Completion Mode - Truthfulness0.73Truthfulness Score49.5
pfgen-bench - Completion Mode - Fluency0.57Fluency Score49.2
pfgen-bench - Completion Mode - Score0.47pfgen Score (mean of three)49.2
Open Japanese LLM - Mbpp Pylint Check27.11Score (%)48.2
pfgen-bench - Completion Mode - Helpfulness0.11Helpfulness Score47.4
Open Japanese LLM - Wiki Reading Char F174.7Score (%)45.7
Open Japanese LLM - QA50.49Score (%)44
Open Japanese LLM - Niilc Char F144.13Score (%)39.2
Swallow - Pre-trained Japanese - JEMHopQA46.3Character F1 (%)37.8
Swallow - Pre-trained Japanese - NIILC44.9Character F1 (%)36.7
Open Japanese LLM - Jemhopqa Char F145.16Score (%)30.8

Interactive version: theaggregate.ai/model?slug=llm-jp-3-1-8b · How It Works · Data refreshed daily, snapshot 2026-09-19.