BTZSC — leaderboard

Zero-shot text classification benchmark for cross-encoders, embedding models, rerankers, and LLM classifiers.

Metric: Macro-F1 (%). Source: huggingface.co. Status: saturation imminent. 35 models tracked.

Top models

#ModelScore
1Mistral Nemo Instruct (2407)66.97
2Qwen 3 8B66.49
3Qwen 3 4B64.86
4Phi-4 Mini Instruct43.09
5Llama 3.2 3B Instruct43.02
6Gemma 3 1B (IT)35.91

Interactive version: theaggregate.ai/benchmark?slug=btzsc · How the rankings work · Data refreshed daily, snapshot 2026-07-22.