Qwen Turbo (2024-11-01): benchmark results

Provider: Alibaba. Released 2024-09-19. Access: API.

Unified ELO 1498 ± 44, rank #1118 of 2656 rated models, from 21 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - OAB Exams60.91Accuracy (%)93.1
Open Portuguese LLM - BLUEX70.79Accuracy (%)92.3
Open Portuguese LLM - ENEM77.96Accuracy (%)91.7
Open Portuguese LLM - FaQuAD NLI81.28Macro F1 (%)91.7
Open Portuguese LLM - ASSIN2 RTE92.6Macro F1 (%)80.9
MATH Level 556.23Accuracy (%)48.6
Open Portuguese LLM - ASSIN2 STS76.4Pearson Correlation (×100)29.3
Open Portuguese LLM - Hate Speech72.39F1 (%)29.3
Open Portuguese LLM - HateBR Offensive85.68F1 (%)22
Open Portuguese LLM - TweetSentBR70.38F1 (%)19.5
Epoch AI - GPQA Diamond41.79Accuracy (%)16.3
Open Portuguese LLM Leaderboard76.49Average Score (%)12.2

Interactive version: theaggregate.ai/model?slug=qwen-turbo-2024-11-01 · How It Works · Data refreshed daily, snapshot 2026-09-19.