Llama-Krikri-8B-Instruct: benchmark results

Greek-language instruct model from Athena RC's ILSP, continually pretrained from Llama 3.1 8B on ~110B mostly Greek tokens then aligned. Provider: Meta. Released 2025-02-07. Access: Open.

Unified ELO 1520 ± 1, rank #601 of 1392 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
FinBen - FinText44.54Normalized Score79.2
Greek MMLU - Greek-Specific74.73Accuracy (%)72.8
Greek MMLU - Humanities70.29Accuracy (%)72.8
Greek MMLU - Social Sciences70.57Accuracy (%)72.8
Open LLM Leaderboard - IFEval60.79Score72.8
Greek MMLU66.47Accuracy (%)70.4
Greek MMLU - Other64.11Accuracy (%)69.1
Greek MMLU - STEM62.62Accuracy (%)65.4
Open LLM Leaderboard - GPQA7.05Score59.2
Open LLM Leaderboard - MATH Level 511.78Score53.1
Open LLM Leaderboard - MuSR10.46Score52.6
Open LLM Leaderboard - BBH29.31Score49.3

Interactive version: theaggregate.ai/model?slug=llama-krikri-8b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.