Dutch

MTEB: Dutch est un benchmark communautaire créé par MTEB / embeddings-benchmark dans le cadre de MTEB-NL. Il évalue la qualité des embeddings de textes en néerlandais sur un ensemble diversifié de tâches, allant de la classification à la recherche, en passant par le clustering et la…

MTEB: Dutch est un benchmark communautaire créé par MTEB / embeddings-benchmark dans le cadre de MTEB-NL. Il évalue la qualité des embeddings de textes en néerlandais sur un ensemble diversifié de tâches, allant de la classification à la recherche, en passant par le clustering et la similarité sémantique.

Son rôle consiste à comparer la capacité des modèles à produire des représentations textuelles utiles dans plusieurs contextes. Cette couverture permet une appréciation transversale des performances, plutôt qu’une évaluation limitée à un seul usage des embeddings.

Carte d'identité

CaractéristiqueValeur
Éditeur du benchmarkMTEB / embeddings-benchmark (communauté) — benchmark néerlandais MTEB-NL
Capacités mesuréesQualité des embeddings de texte en néerlandais à travers classification, clustering, classification de paires/multilabel, reranking, recherche et similarité sémantique
ModalitéTexte
Type de questionstâches d'embedding de texte (classification, clustering, pair/multilabel classification, reranking, retrieval, STS)
Métrique d'évaluationscore principal par tâche (ex. nDCG@10, accuracy, corrélation de Spearman) moyenné
AccèsPublic
LicenceApache-2.0
Languesnéerlandais (nld)
Taille du jeuplusieurs dizaines de jeux de données néerlandais
Année de publication2025
RessourcesSite / dépôt officiel · Article scientifique

Classement des modèles (113)

#ModèleÉditeurLicenceScoreSortieFiabilité
1codefuse-ai/F2LLM-v2-14Bcodefuse-ai🟢 Ouvert66,4 %9 mars 2026✅ Mesuré
2nvidia/llama-embed-nemotron-8bNVIDIA🟢 Ouvert66,2 %23 octobre 2025✅ Mesuré
3codefuse-ai/F2LLM-v2-8Bcodefuse-ai🟢 Ouvert65,8 %9 mars 2026✅ Mesuré
4Octen/Octen-Embedding-8BOcten🟢 Ouvert65,6 %23 décembre 2025✅ Mesuré
5Qwen: Qwen3 Embedding 8BAlibaba Cloud / Qwen Team🟢 Ouvert65,6 %28 octobre 2025✅ Mesuré
6codefuse-ai/F2LLM-v2-4Bcodefuse-ai🟢 Ouvert64,1 %9 mars 2026✅ Mesuré
7Octen/Octen-Embedding-4BOcten🟢 Ouvert63,8 %30 décembre 2025✅ Mesuré
8Qwen: Qwen3 Embedding 4BAlibaba Cloud / Qwen Team🟢 Ouvert63,7 %28 octobre 2025✅ Mesuré
9Salesforce/SFR-Embedding-2_RSalesforce🟢 Ouvert63,5 %14 juin 2024✅ Mesuré
10Linq-AI-Research/Linq-Embed-MistralLinq-AI-Research🟢 Ouvert63,1 %29 mai 2024✅ Mesuré
11codefuse-ai/F2LLM-v2-1.7Bcodefuse-ai🟢 Ouvert62,7 %9 mars 2026✅ Mesuré
12Salesforce/SFR-Embedding-MistralSalesforce🟢 Ouvert62,6 %24 janvier 2024✅ Mesuré
13BidirLM/BidirLM-1.7B-EmbeddingBidirLM🟢 Ouvert60,5 %7 avril 2026✅ Mesuré
14codefuse-ai/F2LLM-v2-0.6Bcodefuse-ai🟢 Ouvert59,5 %9 mars 2026✅ Mesuré
15microsoft/harrier-oss-v1-0.6bMicrosoft🟢 Ouvert59,4 %27 mars 2026✅ Mesuré
16BidirLM/BidirLM-1B-EmbeddingBidirLM🟢 Ouvert59,2 %7 avril 2026✅ Mesuré
17Mira190/Euler-Legal-Embedding-V1Mira190🟢 Ouvert58,4 %6 novembre 2025✅ Mesuré
18intfloat/multilingual-e5-large-instructIntfloat🟢 Ouvert58,4 %8 février 2024✅ Mesuré
19codefuse-ai/F2LLM-v2-330Mcodefuse-ai🟢 Ouvert57,6 %9 mars 2026✅ Mesuré
20jinaai/jina-embeddings-v3Jina AI🟢 Ouvert57,0 %18 septembre 2024✅ Mesuré
21clips/e5-large-trm-nlclips🟢 Ouvert56,4 %23 septembre 2025✅ Mesuré
22OrdalieTech/Solon-embeddings-large-0.1OrdalieTech🟢 Ouvert56,3 %9 décembre 2023✅ Mesuré
23Lajavaness/bilingual-embedding-largeLajavaness🟢 Ouvert56,2 %24 juin 2024✅ Mesuré
24BidirLM/BidirLM-0.6B-EmbeddingBidirLM🟢 Ouvert56,2 %7 avril 2026✅ Mesuré
25microsoft/harrier-oss-v1-270mMicrosoft🟢 Ouvert55,9 %27 mars 2026✅ Mesuré
26Snowflake/snowflake-arctic-embed-l-v2.0Snowflake🟢 Ouvert55,2 %4 décembre 2024✅ Mesuré
27BAAI: bge-m3BAAI🟢 Ouvert54,8 %18 novembre 2025✅ Mesuré
28Intfloat: Multilingual-E5-LargeIntfloat🟢 Ouvert54,7 %18 novembre 2025✅ Mesuré
29clips/e5-base-trm-nlclips🟢 Ouvert54,5 %23 septembre 2025✅ Mesuré
30Qwen: Qwen3 Embedding 0.6BAlibaba Cloud / Qwen Team🟢 Ouvert54,3 %5 novembre 2025✅ Mesuré
31ibm-granite/granite-embedding-311m-multilingual-r2IBM🟢 Ouvert54,1 %29 avril 2026✅ Mesuré
32Alibaba-NLP/gte-multilingual-baseAlibaba🟢 Ouvert53,6 %20 juillet 2024✅ Mesuré
33Lajavaness/bilingual-embedding-baseLajavaness🟢 Ouvert53,6 %26 juin 2024✅ Mesuré
34manu/bge-m3-custom-frmanu🟢 Ouvert53,5 %11 avril 2024✅ Mesuré
35clips/e5-small-trm-nlclips🟢 Ouvert53,3 %23 septembre 2025✅ Mesuré
36codefuse-ai/F2LLM-v2-160Mcodefuse-ai🟢 Ouvert53,0 %9 mars 2026✅ Mesuré
37intfloat/multilingual-e5-baseIntfloat🟢 Ouvert52,4 %8 février 2024✅ Mesuré
38Lajavaness/bilingual-embedding-smallLajavaness🟢 Ouvert51,9 %17 juillet 2024✅ Mesuré
39ibm-granite/granite-embedding-97m-multilingual-r2IBM🟢 Ouvert51,4 %29 avril 2026✅ Mesuré
40BidirLM/BidirLM-270M-EmbeddingBidirLM🟢 Ouvert50,9 %7 avril 2026✅ Mesuré
41intfloat/multilingual-e5-smallIntfloat🟢 Ouvert50,8 %8 février 2024✅ Mesuré
42codefuse-ai/F2LLM-v2-80Mcodefuse-ai🟢 Ouvert50,5 %9 mars 2026✅ Mesuré
43Snowflake/snowflake-arctic-embed-m-v2.0Snowflake🟢 Ouvert50,3 %4 décembre 2024✅ Mesuré
44ibm-granite/granite-embedding-278m-multilingualIBM🟢 Ouvert50,2 %18 décembre 2024✅ Mesuré
45ibm-granite/granite-embedding-107m-multilingualIBM🟢 Ouvert49,1 %18 décembre 2024✅ Mesuré
46sentence-transformers/paraphrase-multilingual-mpnet-base-v2Sentence Transformers🟢 Ouvert49,0 %1 novembre 2019✅ Mesuré
47Omartificial-Intelligence-Space/Arabic-all-nli-triplet-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert48,6 %14 juin 2024✅ Mesuré
48Omartificial-Intelligence-Space/Arabic-labse-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert46,9 %16 juin 2024✅ Mesuré
49sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2Sentence Transformers🟢 Ouvert45,8 %1 novembre 2019✅ Mesuré
50omarelshehy/arabic-english-sts-matryoshkaomarelshehy🟢 Ouvert45,7 %13 octobre 2024✅ Mesuré
51Gameselo/STS-multilingual-mpnet-base-v2Gameselo🟢 Ouvert45,4 %7 juin 2024✅ Mesuré
52Omartificial-Intelligence-Space/Arabic-MiniLM-L12-v2-all-nli-tripletOmartificial-Intelligence-Space🟢 Ouvert45,2 %25 juin 2024✅ Mesuré
53sentence-transformers/LaBSESentence Transformers🟢 Ouvert44,2 %1 novembre 2019✅ Mesuré
54Intfloat: E5-Large-v2Intfloat🟢 Ouvert43,1 %18 novembre 2025✅ Mesuré
55WhereIsAI/UAE-Large-V1WhereIsAI🟢 Ouvert43,0 %4 décembre 2023✅ Mesuré
56intfloat/e5-largeIntfloat🟢 Ouvert42,8 %26 décembre 2022✅ Mesuré
57sentence-transformers/gtr-t5-largeSentence Transformers🟢 Ouvert42,8 %9 février 2022✅ Mesuré
58BAAI: bge-large-en-v1.5BAAI🟢 Ouvert42,8 %18 novembre 2025✅ Mesuré
59mixedbread-ai/mxbai-embed-large-v1Mixedbread AI🟢 Ouvert42,6 %7 mars 2024✅ Mesuré
60minishlab/potion-multilingual-128Mminishlab🟢 Ouvert42,4 %23 mai 2025✅ Mesuré
61Intfloat: E5-Base-v2Intfloat🟢 Ouvert42,2 %18 novembre 2025✅ Mesuré
62avsolatorio/GIST-large-Embedding-v0avsolatorio🟢 Ouvert41,5 %14 février 2024✅ Mesuré
63intfloat/e5-baseIntfloat🟢 Ouvert41,2 %26 décembre 2022✅ Mesuré
64BAAI: bge-base-en-v1.5BAAI🟢 Ouvert41,0 %18 novembre 2025✅ Mesuré
65ibm-granite/granite-embedding-125m-englishIBM🟢 Ouvert40,8 %18 décembre 2024✅ Mesuré
66sentence-transformers/sentence-t5-largeSentence Transformers🟢 Ouvert40,8 %9 février 2022✅ Mesuré
67Snowflake/snowflake-arctic-embed-lSnowflake🟢 Ouvert40,7 %12 avril 2024✅ Mesuré
68shibing624/text2vec-base-multilingualshibing624🟢 Ouvert40,6 %22 juin 2023✅ Mesuré
69avsolatorio/GIST-Embedding-v0avsolatorio🟢 Ouvert40,0 %31 janvier 2024✅ Mesuré
70sentence-transformers/static-similarity-mrl-multilingual-v1Sentence Transformers🟢 Ouvert39,9 %15 janvier 2025✅ Mesuré
71intfloat/e5-small-v2Intfloat🟢 Ouvert39,9 %8 février 2024✅ Mesuré
72BAAI/bge-small-en-v1.5BAAI🟢 Ouvert39,8 %12 septembre 2023✅ Mesuré
73sdadas/mmlw-e5-largesdadas🟢 Ouvert39,7 %17 novembre 2023✅ Mesuré
74abhinand/MedEmbed-small-v0.1abhinand🟢 Ouvert39,4 %20 octobre 2024✅ Mesuré
75intfloat/e5-smallIntfloat🟢 Ouvert39,4 %8 février 2024✅ Mesuré
76Snowflake/snowflake-arctic-embed-sSnowflake🟢 Ouvert39,4 %12 avril 2024✅ Mesuré
77sdadas/mmlw-roberta-largesdadas🟢 Ouvert38,5 %17 novembre 2023✅ Mesuré
78Snowflake/snowflake-arctic-embed-mSnowflake🟢 Ouvert38,4 %12 avril 2024✅ Mesuré
79GritLM/GritLM-7BGritLM🟢 Ouvert38,4 %15 février 2024✅ Mesuré
80avsolatorio/GIST-small-Embedding-v0avsolatorio🟢 Ouvert38,4 %3 février 2024✅ Mesuré
81ibm-granite/granite-embedding-30m-englishIBM🟢 Ouvert37,5 %18 décembre 2024✅ Mesuré
82Snowflake/snowflake-arctic-embed-m-v1.5Snowflake🟢 Ouvert37,2 %8 juillet 2024✅ Mesuré
83Sentence Transformers: all-mpnet-base-v2Sentence Transformers🟢 Ouvert36,6 %17 novembre 2025✅ Mesuré
84sdadas/mmlw-e5-basesdadas🟢 Ouvert36,6 %17 novembre 2023✅ Mesuré
85sentence-transformers/sentence-t5-baseSentence Transformers🟢 Ouvert36,4 %9 février 2022✅ Mesuré
86sdadas/mmlw-roberta-basesdadas🟢 Ouvert36,4 %17 novembre 2023✅ Mesuré
87jinaai/jina-embedding-b-en-v1Jina AI🟢 Ouvert36,3 %7 juillet 2023✅ Mesuré
88avsolatorio/GIST-all-MiniLM-L6-v2avsolatorio🟢 Ouvert36,1 %3 février 2024✅ Mesuré
89Snowflake/snowflake-arctic-embed-xsSnowflake🟢 Ouvert35,1 %8 juillet 2024✅ Mesuré
90sentence-transformers/multi-qa-MiniLM-L6-cos-v1Sentence Transformers🟢 Ouvert34,6 %30 août 2021✅ Mesuré
91sdadas/mmlw-e5-smallsdadas🟢 Ouvert34,5 %17 novembre 2023✅ Mesuré
92Sentence Transformers: all-MiniLM-L6-v2Sentence Transformers🟢 Ouvert34,2 %17 novembre 2025✅ Mesuré
93Mihaiii/WartortleMihaiii🟢 Ouvert33,3 %30 avril 2024✅ Mesuré
94ai-forever/ru-en-RoSBERTaai-forever🟢 Ouvert32,4 %29 juillet 2024✅ Mesuré
95jinaai/jina-embedding-s-en-v1Jina AI🟢 Ouvert32,2 %7 juillet 2023✅ Mesuré
96Mihaiii/SquirtleMihaiii🟢 Ouvert32,2 %30 avril 2024✅ Mesuré
97minishlab/M2V_base_glove_subwordminishlab🟢 Ouvert30,6 %21 septembre 2024✅ Mesuré
98minishlab/potion-base-8Mminishlab🟢 Ouvert30,1 %29 octobre 2024✅ Mesuré
99minishlab/M2V_base_outputminishlab🟢 Ouvert29,7 %21 septembre 2024✅ Mesuré
100minishlab/potion-base-4Mminishlab🟢 Ouvert28,8 %29 octobre 2024✅ Mesuré
101sergeyzh/rubert-tiny-turbosergeyzh🟢 Ouvert27,2 %21 juin 2024✅ Mesuré
102minishlab/potion-base-2Mminishlab🟢 Ouvert26,2 %29 octobre 2024✅ Mesuré
103cointegrated/rubert-tinycointegrated🟢 Ouvert25,7 %24 mai 2021✅ Mesuré
104DeepPavlov/rubert-base-cased-sentenceDeepPavlov🟢 Ouvert25,4 %4 mars 2020✅ Mesuré
105Omartificial-Intelligence-Space/Arabic-mpnet-base-all-nli-tripletOmartificial-Intelligence-Space🟢 Ouvert25,4 %15 juin 2024✅ Mesuré
106Omartificial-Intelligence-Space/Arabert-all-nli-triplet-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert25,3 %16 juin 2024✅ Mesuré
107cointegrated/rubert-tiny2cointegrated🟢 Ouvert24,8 %28 octobre 2021✅ Mesuré
108DeepPavlov/distilrubert-small-cased-conversationalDeepPavlov🟢 Ouvert23,7 %28 juin 2022✅ Mesuré
109Omartificial-Intelligence-Space/Marbert-all-nli-triplet-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert23,4 %17 juin 2024✅ Mesuré
110deepvk/deberta-v1-basedeepvk🟢 Ouvert22,5 %7 février 2023✅ Mesuré
111malenia1/ternary-weight-embeddingmalenia1🟢 Ouvert22,3 %23 octobre 2024✅ Mesuré
112ai-forever/sbert_large_mt_nlu_ruai-forever🟢 Ouvert21,5 %18 mai 2021✅ Mesuré
113ai-forever/sbert_large_nlu_ruai-forever🟢 Ouvert21,3 %20 novembre 2020✅ Mesuré

Classement établi sur 113 modèles évalués, dont 3 de grands éditeurs. Score médian de l'ensemble : 42,8 %.

Notre analyse

Un score élevé indique qu’un modèle obtient de bons résultats moyens sur des tâches aux objectifs et métriques variés, notamment nDCG@10, l’accuracy et la corrélation de Spearman. Cette moyenne facilite la comparaison globale, mais peut masquer des écarts entre classification, reranking, recherche ou similarité sémantique. La rigueur du classement doit aussi être nuancée, car les scores sont majoritairement auto-déclarés par les éditeurs plutôt que produits dans un cadre de mesure entièrement indépendant.

Avec un meilleur score de 66 % contre une médiane de 43 %, le classement fait apparaître un écart net entre le modèle de tête, codefuse-ai/F2LLM-v2-14B, et le niveau central de l’ensemble évalué. Ce résultat ne suggère pas une saturation complète du benchmark. Sa portée reste toutefois circonscrite aux embeddings de textes en néerlandais et aux familles de tâches couvertes. Son accès public implique également que la contamination constitue un risque méthodologique à considérer lors de l’interprétation des résultats, sans établir qu’elle affecte effectivement les scores publiés.


Sources des scores : mteb.