PL-MTEB: leaderboard

Polish Massive Text Embedding Benchmark leaderboard evaluating embedding models across Polish classification, clustering, pair classification, semantic textual similarity, and retrieval tasks.

Metric: Mean Main Score (%). Source: huggingface.co. 22 models tracked.

Top models

#ModelScore
1gte-Qwen2-7B-instruct65.86
2bge-multilingual-gemma264.72
3gte-Qwen2-1.5B-instruct62.85
4mmlw-roberta-large61.87
5mmlw-roberta-base59.79
6mmlw-e5-large59.74
7KartonBERT-USE-base-v159.04
8mmlw-e5-base58.54
9multilingual-e5-large58.5
10bge-m357.19

Interactive version: theaggregate.ai/benchmark?slug=pl-mteb · How It Works · Data refreshed daily, snapshot 2026-09-05.