Llama-SEA-LION-v3-70B-IT: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1618 ± 18, rank #377 of 1632 rated models, from 152 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
FilBench - Cultural Knowledge76.78Category Score (%)100
SEA-HELM (Thai) - SEA-Safeguard77.46Normalized Score100
SEA-HELM (Vietnamese) - Summarization19.81Normalized Score100
SEA-HELM (Indonesian) - Summarization19.14Normalized Score98.2
SEA-HELM (Tamil) - Summarization14.12Normalized Score98.2
SEA-HELM (Thai) - Summarization25.38Normalized Score98.2
SEA-HELM (Vietnamese) - NLG56.27Normalized Score98.2
FilBench - Classical NLP89.99Category Score (%)97.2
SEA-HELM (Indonesian) - NLG56.02Normalized Score96.5
ThaiSafetyBench - Human-Chatbot Interaction Harms12.39Attack Success Rate (%)95.7
SEA-HELM (Filipino) - NLG57.42Normalized Score93
SEA-HELM (Filipino) - Summarization25.04Normalized Score93

Interactive version: theaggregate.ai/model?slug=llama-sea-lion-v3-70b-it · How It Works · Data refreshed daily, snapshot 2026-10-08.