Llama-Krikri-8B-Instruct — benchmark results

Greek-language instruct model from Athena RC's ILSP, continually pretrained from Llama 3.1 8B on ~110B mostly Greek tokens then aligned. Provider: Meta. Released 2025-02-07. Access: Open.

Unified ELO 1542 ± 51, rank #645 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
FinBen - FinText44.54Normalized Score79.2
Greek MMLU - Greek-Specific74.73Accuracy (%)72.8
Greek MMLU - Humanities70.29Accuracy (%)72.8
Greek MMLU - Social Sciences70.57Accuracy (%)72.8
Open LLM Leaderboard - IFEval60.79Score72.8
Open FinLLM Leaderboard30.79Average normalized score (self-reported)70.8
Greek MMLU66.47Accuracy (%)70.4
Greek MMLU - Other64.11Accuracy (%)69.1
Greek MMLU - STEM62.62Accuracy (%)65.4
Open LLM Leaderboard - GPQA7.05Score59.2
Open LLM Leaderboard - MATH Level 511.78Score53.1
Open LLM Leaderboard - MuSR10.46Score52.6

Interactive version: theaggregate.ai/model?slug=llama-krikri-8b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.