EuroEval French NLU - Eltec — leaderboard

Metric: Named entity recognition Score (%). Source: euroeval.com. 375 models tracked.

Top models

#ModelScore
1Claude Sonnet 4.5 (Non-reasoning)80.67
2Claude Sonnet 4.5 (Thinking)79.18
3Gemma 4 31B (IT)77.35
4GPT-5.4 Mini (High)76.97
5OLMo 3 7B (Thinking)76.8
6Gemini 3 Pro (Preview)76.68
7Qwen 3 Next 80B A3B (Thinking)75.31
8Gemma 4 26B A4B (IT)73.59
9Qwen 3 4B 2507 (Thinking)73.38
10Grok 4.1 Fast (Reasoning)73.16
11Claude Sonnet 4.673.13
12GPT-5 Nano72.81
13GPT-5.4 Mini (Medium)72.13
14OLMo 3.1 32B (Thinking)72.07
15Reka Flash 371.29

Interactive version: theaggregate.ai/benchmark?slug=euroeval-french-nlu-eltec · How the rankings work · Data refreshed daily, snapshot 2026-07-22.