European

MTEB: European est un benchmark public consacré à la qualité des embeddings de texte dans les langues européennes. Créé par MTEB / MMTEB, dans le cadre d’embeddings-benchmark et des travaux de Kenneth Enevoldsen et al., il couvre plusieurs usages, de la recherche d’information à la…

MTEB: European est un benchmark public consacré à la qualité des embeddings de texte dans les langues européennes. Créé par MTEB / MMTEB, dans le cadre d’embeddings-benchmark et des travaux de Kenneth Enevoldsen et al., il couvre plusieurs usages, de la recherche d’information à la similarité sémantique.

Publié en 2025, il évalue la capacité des modèles à produire des représentations textuelles utiles pour le bitext mining, la classification, le clustering, la pair classification, le retrieval, le reranking et le STS. Son agrégation offre une vue synthétique des performances multilingues.

Carte d'identité

CaractéristiqueValeur
Éditeur du benchmarkMTEB / MMTEB (embeddings-benchmark, Kenneth Enevoldsen et al.)
Capacités mesuréesQualité des embeddings de texte à travers les langues européennes : bitext mining, classification, clustering, pair classification, retrieval, reranking et similarité sémantique.
ModalitéTexte
Type de questionsÉvaluation d'embeddings de texte multilingues (bitext mining, classification, clustering, pair classification, retrieval, reranking, STS)
Métrique d'évaluationScore dépendant de la tâche (nDCG@10, accuracy, V-measure, Spearman), agrégé
AccèsPublic
LanguesLangues européennes
Année de publication2025
RessourcesSite / dépôt officiel · Article scientifique

Classement des modèles (127)

#ModèleÉditeurLicenceScoreSortieFiabilité
1codefuse-ai/F2LLM-v2-14Bcodefuse-ai🟢 Ouvert69,9 %9 mars 2026✅ Mesuré
2codefuse-ai/F2LLM-v2-8Bcodefuse-ai🟢 Ouvert69,2 %9 mars 2026✅ Mesuré
3codefuse-ai/F2LLM-v2-4Bcodefuse-ai🟢 Ouvert68,6 %9 mars 2026✅ Mesuré
4codefuse-ai/F2LLM-v2-1.7Bcodefuse-ai🟢 Ouvert66,9 %9 mars 2026✅ Mesuré
5codefuse-ai/F2LLM-v2-0.6Bcodefuse-ai🟢 Ouvert64,5 %9 mars 2026✅ Mesuré
6Alibaba-NLP/gte-Qwen2-7B-instructAlibaba🟢 Ouvert63,6 %15 juin 2024✅ Mesuré
7Linq-AI-Research/Linq-Embed-MistralLinq-AI-Research🟢 Ouvert63,3 %29 mai 2024✅ Mesuré
8GritLM/GritLM-7BGritLM🟢 Ouvert63,0 %15 février 2024✅ Mesuré
9Salesforce/SFR-Embedding-MistralSalesforce🟢 Ouvert62,6 %24 janvier 2024✅ Mesuré
10GritLM/GritLM-8x7BGritLM🟢 Ouvert62,3 %15 février 2024✅ Mesuré
11Salesforce/SFR-Embedding-2_RSalesforce🟢 Ouvert62,3 %14 juin 2024✅ Mesuré
12intfloat/multilingual-e5-large-instructIntfloat🟢 Ouvert62,2 %8 février 2024✅ Mesuré
13codefuse-ai/F2LLM-v2-330Mcodefuse-ai🟢 Ouvert62,0 %9 mars 2026✅ Mesuré
14Alibaba-NLP/gte-Qwen1.5-7B-instructAlibaba🟢 Ouvert62,0 %20 avril 2024✅ Mesuré
15Alibaba-NLP/gte-Qwen2-1.5B-instructAlibaba🟢 Ouvert61,8 %29 juillet 2024✅ Mesuré
16Cohere/Cohere-embed-multilingual-v3.0Cohere🟢 Ouvert61,5 %2 novembre 2023✅ Mesuré
17intfloat/e5-mistral-7b-instructIntfloat🟢 Ouvert61,3 %8 février 2024✅ Mesuré
18jinaai/jina-embeddings-v3Jina AI🟢 Ouvert60,7 %18 septembre 2024✅ Mesuré
19Lajavaness/bilingual-embedding-largeLajavaness🟢 Ouvert60,6 %24 juin 2024✅ Mesuré
20NovaSearch/stella_en_1.5B_v5NovaSearch🟢 Ouvert59,8 %12 juillet 2024✅ Mesuré
21OrdalieTech/Solon-embeddings-large-0.1OrdalieTech🟢 Ouvert59,4 %9 décembre 2023✅ Mesuré
22codefuse-ai/F2LLM-v2-160Mcodefuse-ai🟢 Ouvert59,1 %9 mars 2026✅ Mesuré
23Alibaba-NLP/gte-multilingual-baseAlibaba🟢 Ouvert59,0 %20 juillet 2024✅ Mesuré
24manu/bge-m3-custom-frmanu🟢 Ouvert58,9 %11 avril 2024✅ Mesuré
25nvidia/NV-Embed-v2NVIDIA🟢 Ouvert58,6 %9 septembre 2024✅ Mesuré
26Snowflake/snowflake-arctic-embed-l-v2.0Snowflake🟢 Ouvert58,4 %4 décembre 2024✅ Mesuré
27Intfloat: Multilingual-E5-LargeIntfloat🟢 Ouvert58,3 %18 novembre 2025✅ Mesuré
28Lajavaness/bilingual-embedding-baseLajavaness🟢 Ouvert58,2 %26 juin 2024✅ Mesuré
29HIT-TMG/KaLM-embedding-multilingual-mini-instruct-v1HIT-TMG🟢 Ouvert57,8 %23 octobre 2024✅ Mesuré
30Cohere/Cohere-embed-multilingual-light-v3.0Cohere🟢 Ouvert57,8 %2 novembre 2023✅ Mesuré
31HIT-TMG/KaLM-embedding-multilingual-mini-v1HIT-TMG🟢 Ouvert57,6 %27 août 2024✅ Mesuré
32intfloat/multilingual-e5-baseIntfloat🟢 Ouvert57,2 %8 février 2024✅ Mesuré
33nvidia/NV-Embed-v1NVIDIA🟢 Ouvert56,9 %13 septembre 2024✅ Mesuré
34Lajavaness/bilingual-embedding-smallLajavaness🟢 Ouvert56,9 %17 juillet 2024✅ Mesuré
35codefuse-ai/F2LLM-v2-80Mcodefuse-ai🟢 Ouvert56,2 %9 mars 2026✅ Mesuré
36intfloat/multilingual-e5-smallIntfloat🟢 Ouvert55,6 %8 février 2024✅ Mesuré
37Snowflake/snowflake-arctic-embed-m-v2.0Snowflake🟢 Ouvert55,5 %4 décembre 2024✅ Mesuré
38ibm-granite/granite-embedding-278m-multilingualIBM🟢 Ouvert54,6 %18 décembre 2024✅ Mesuré
39sentence-transformers/paraphrase-multilingual-mpnet-base-v2Sentence Transformers🟢 Ouvert54,4 %1 novembre 2019✅ Mesuré
40Omartificial-Intelligence-Space/Arabic-labse-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert54,1 %16 juin 2024✅ Mesuré
41Omartificial-Intelligence-Space/Arabic-all-nli-triplet-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert54,1 %14 juin 2024✅ Mesuré
42NovaSearch/stella_en_400M_v5NovaSearch🟢 Ouvert53,9 %12 juillet 2024✅ Mesuré
43omarelshehy/arabic-english-sts-matryoshkaomarelshehy🟢 Ouvert53,5 %13 octobre 2024✅ Mesuré
44ibm-granite/granite-embedding-107m-multilingualIBM🟢 Ouvert52,5 %18 décembre 2024✅ Mesuré
45Cohere/Cohere-embed-english-v3.0Cohere🟢 Ouvert52,2 %2 novembre 2023✅ Mesuré
46sentence-transformers/LaBSESentence Transformers🟢 Ouvert51,8 %1 novembre 2019✅ Mesuré
47sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2Sentence Transformers🟢 Ouvert51,7 %1 novembre 2019✅ Mesuré
48Omartificial-Intelligence-Space/Arabic-MiniLM-L12-v2-all-nli-tripletOmartificial-Intelligence-Space🟢 Ouvert51,7 %25 juin 2024✅ Mesuré
49Intfloat: E5-Large-v2Intfloat🟢 Ouvert50,4 %18 novembre 2025✅ Mesuré
50Gameselo/STS-multilingual-mpnet-base-v2Gameselo🟢 Ouvert49,9 %7 juin 2024✅ Mesuré
51sentence-transformers/static-similarity-mrl-multilingual-v1Sentence Transformers🟢 Ouvert49,8 %15 janvier 2025✅ Mesuré
52intfloat/e5-largeIntfloat🟢 Ouvert49,7 %26 décembre 2022✅ Mesuré
53manu/sentence_croissant_alpha_v0.4manu🟢 Ouvert49,7 %27 avril 2024✅ Mesuré
54WhereIsAI/UAE-Large-V1WhereIsAI🟢 Ouvert49,5 %4 décembre 2023✅ Mesuré
55manu/sentence_croissant_alpha_v0.3manu🟢 Ouvert49,5 %26 avril 2024✅ Mesuré
56Intfloat: E5-Base-v2Intfloat🟢 Ouvert49,4 %18 novembre 2025✅ Mesuré
57mixedbread-ai/mxbai-embed-large-v1Mixedbread AI🟢 Ouvert49,3 %7 mars 2024✅ Mesuré
58nomic-ai/nomic-embed-text-v1-ablatedNomic AI🟢 Ouvert49,2 %15 janvier 2024✅ Mesuré
59manu/sentence_croissant_alpha_v0.2manu🟢 Ouvert49,2 %15 mars 2024✅ Mesuré
60avsolatorio/GIST-large-Embedding-v0avsolatorio🟢 Ouvert49,2 %14 février 2024✅ Mesuré
61Cohere/Cohere-embed-english-light-v3.0Cohere🟢 Ouvert49,0 %2 novembre 2023✅ Mesuré
62nomic-ai/nomic-embed-text-v1-unsupervisedNomic AI🟢 Ouvert49,0 %15 janvier 2024✅ Mesuré
63sdadas/mmlw-e5-largesdadas🟢 Ouvert48,9 %17 novembre 2023✅ Mesuré
64Thenlper: GTE-LargeAlibaba🟢 Ouvert48,9 %18 novembre 2025✅ Mesuré
65intfloat/e5-baseIntfloat🟢 Ouvert48,6 %26 décembre 2022✅ Mesuré
66BAAI: bge-large-en-v1.5BAAI🟢 Ouvert48,5 %18 novembre 2025✅ Mesuré
67nomic-ai/nomic-embed-text-v1Nomic AI🟢 Ouvert48,4 %31 janvier 2024✅ Mesuré
68dwzhu/e5-base-4kdwzhu🟢 Ouvert48,3 %28 mars 2024✅ Mesuré
69shibing624/text2vec-base-multilingualshibing624🟢 Ouvert48,3 %22 juin 2023✅ Mesuré
70avsolatorio/GIST-Embedding-v0avsolatorio🟢 Ouvert47,9 %31 janvier 2024✅ Mesuré
71sdadas/mmlw-roberta-largesdadas🟢 Ouvert47,8 %17 novembre 2023✅ Mesuré
72infgrad/stella-base-en-v2infgrad🟢 Ouvert47,6 %19 octobre 2023✅ Mesuré
73Thenlper: GTE-BaseAlibaba🟢 Ouvert47,5 %18 novembre 2025✅ Mesuré
74intfloat/e5-small-v2Intfloat🟢 Ouvert47,4 %8 février 2024✅ Mesuré
75intfloat/e5-smallIntfloat🟢 Ouvert47,4 %8 février 2024✅ Mesuré
76minishlab/potion-multilingual-128Mminishlab🟢 Ouvert47,3 %23 mai 2025✅ Mesuré
77avsolatorio/NoInstruct-small-Embedding-v0avsolatorio🟢 Ouvert47,1 %1 mai 2024✅ Mesuré
78deepfile/embedder-100pdeepfile🟢 Ouvert47,1 %24 juillet 2023✅ Mesuré
79BAAI: bge-base-en-v1.5BAAI🟢 Ouvert46,9 %18 novembre 2025✅ Mesuré
80avsolatorio/GIST-small-Embedding-v0avsolatorio🟢 Ouvert46,7 %3 février 2024✅ Mesuré
81thenlper/gte-smallAlibaba🟢 Ouvert46,7 %27 juillet 2023✅ Mesuré
82Snowflake/snowflake-arctic-embed-lSnowflake🟢 Ouvert46,6 %12 avril 2024✅ Mesuré
83sdadas/mmlw-e5-basesdadas🟢 Ouvert46,5 %17 novembre 2023✅ Mesuré
84nomic-ai/nomic-embed-text-v1.5Nomic AI🟢 Ouvert46,3 %10 février 2024✅ Mesuré
85ibm-granite/granite-embedding-125m-englishIBM🟢 Ouvert46,3 %18 décembre 2024✅ Mesuré
86sdadas/mmlw-roberta-basesdadas🟢 Ouvert46,2 %17 novembre 2023✅ Mesuré
87Snowflake/snowflake-arctic-embed-sSnowflake🟢 Ouvert46,1 %12 avril 2024✅ Mesuré
88BAAI/bge-small-en-v1.5BAAI🟢 Ouvert46,1 %12 septembre 2023✅ Mesuré
89Mihaiii/IvysaurMihaiii🟢 Ouvert45,8 %27 avril 2024✅ Mesuré
90Snowflake/snowflake-arctic-embed-m-longSnowflake🟢 Ouvert45,7 %12 avril 2024✅ Mesuré
91jinaai/jina-embedding-b-en-v1Jina AI🟢 Ouvert45,7 %7 juillet 2023✅ Mesuré
92Snowflake/snowflake-arctic-embed-mSnowflake🟢 Ouvert45,6 %12 avril 2024✅ Mesuré
93sdadas/mmlw-e5-smallsdadas🟢 Ouvert45,6 %17 novembre 2023✅ Mesuré
94avsolatorio/GIST-all-MiniLM-L6-v2avsolatorio🟢 Ouvert45,5 %3 février 2024✅ Mesuré
95abhinand/MedEmbed-small-v0.1abhinand🟢 Ouvert45,5 %20 octobre 2024✅ Mesuré
96Sentence Transformers: all-mpnet-base-v2Sentence Transformers🟢 Ouvert44,8 %17 novembre 2025✅ Mesuré
97ibm-granite/granite-embedding-30m-englishIBM🟢 Ouvert44,7 %18 décembre 2024✅ Mesuré
98Sentence Transformers: all-MiniLM-L12-v2Sentence Transformers🟢 Ouvert44,4 %18 novembre 2025✅ Mesuré
99Snowflake/snowflake-arctic-embed-m-v1.5Snowflake🟢 Ouvert44,1 %8 juillet 2024✅ Mesuré
100bigscience/sgpt-bloom-7b1-msmarcobigscience🟢 Ouvert43,6 %26 août 2022✅ Mesuré
101Sentence Transformers: all-MiniLM-L6-v2Sentence Transformers🟢 Ouvert43,4 %17 novembre 2025✅ Mesuré
102brahmairesearch/slx-v0.1brahmairesearch🟢 Ouvert43,4 %13 août 2024✅ Mesuré
103Snowflake/snowflake-arctic-embed-xsSnowflake🟢 Ouvert43,4 %8 juillet 2024✅ Mesuré
104Mihaiii/BulbasaurMihaiii🟢 Ouvert43,1 %27 avril 2024✅ Mesuré
105Mihaiii/gte-micro-v4Mihaiii🟢 Ouvert42,9 %22 avril 2024✅ Mesuré
106jinaai/jina-embedding-s-en-v1Jina AI🟢 Ouvert42,8 %7 juillet 2023✅ Mesuré
107Mihaiii/WartortleMihaiii🟢 Ouvert42,7 %30 avril 2024✅ Mesuré
108ai-forever/ru-en-RoSBERTaai-forever🟢 Ouvert42,0 %29 juillet 2024✅ Mesuré
109aari1995/German_Semantic_STS_V2aari1995🟢 Ouvert41,2 %17 novembre 2022✅ Mesuré
110Mihaiii/SquirtleMihaiii🟢 Ouvert40,9 %30 avril 2024✅ Mesuré
111Mihaiii/gte-microMihaiii🟢 Ouvert40,8 %21 avril 2024✅ Mesuré
112Mihaiii/VenusaurMihaiii🟢 Ouvert40,8 %29 avril 2024✅ Mesuré
113minishlab/potion-base-8Mminishlab🟢 Ouvert39,1 %29 octobre 2024✅ Mesuré
114minishlab/potion-base-4Mminishlab🟢 Ouvert38,1 %29 octobre 2024✅ Mesuré
115minishlab/M2V_base_glove_subwordminishlab🟢 Ouvert37,1 %21 septembre 2024✅ Mesuré
116consciousAI/cai-lunaris-text-embeddingsconsciousAI🟢 Ouvert37,1 %22 juin 2023✅ Mesuré
117minishlab/M2V_base_outputminishlab🟢 Ouvert36,5 %21 septembre 2024✅ Mesuré
118minishlab/potion-base-2Mminishlab🟢 Ouvert36,1 %29 octobre 2024✅ Mesuré
119minishlab/M2V_base_gloveminishlab🟢 Ouvert35,5 %21 septembre 2024✅ Mesuré
120silma-ai/silma-embeddding-matryoshka-v0.1silma-ai🟢 Ouvert33,9 %12 octobre 2024✅ Mesuré
121Omartificial-Intelligence-Space/Arabic-mpnet-base-all-nli-tripletOmartificial-Intelligence-Space🟢 Ouvert33,8 %15 juin 2024✅ Mesuré
122jinaai/jina-embeddings-v2-small-enJina AI🟢 Ouvert33,4 %27 septembre 2023✅ Mesuré
123Jaume/gemma-2b-embeddingsJaume🟢 Ouvert32,7 %29 juin 2024✅ Mesuré
124Omartificial-Intelligence-Space/Arabert-all-nli-triplet-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert32,1 %16 juin 2024✅ Mesuré
125Omartificial-Intelligence-Space/Marbert-all-nli-triplet-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert30,6 %17 juin 2024✅ Mesuré
126malenia1/ternary-weight-embeddingmalenia1🟢 Ouvert27,2 %23 octobre 2024✅ Mesuré
127jinaai/jina-embeddings-v2-base-enJina AI🟢 Ouvert27,2 %27 septembre 2023✅ Mesuré

Classement établi sur 127 modèles évalués, dont 2 de grands éditeurs. Score médian de l'ensemble : 48,9 %.

Notre analyse

Un score élevé indique qu’un modèle obtient globalement de bons résultats sur des tâches variées d’embeddings en langues européennes. L’évaluation combine des métriques adaptées à chaque famille de tâches, notamment nDCG@10, l’accuracy, la V-measure et la corrélation de Spearman, avant agrégation. Cette diversité élargit la portée fonctionnelle du score, mais l’agrégation peut aussi masquer des écarts entre retrieval, classification, clustering ou similarité sémantique. La portée reste centrée sur les langues européennes et sur la qualité des embeddings de texte.

La fiabilité doit être interprétée avec prudence, car les scores sont majoritairement auto-déclarés par les éditeurs plutôt que tous issus d’une mesure indépendante uniforme. Le classement de 127 modèles montre un écart marqué entre le niveau médian, à 49 %, et le meilleur résultat, 70 %, obtenu par codefuse-ai/F2LLM-v2-14B. Ce maximum suggère que le benchmark n’est pas entièrement saturé. Il met surtout en évidence la capacité du modèle de tête à maintenir une performance agrégée élevée sur plusieurs types de tâches multilingues.


Sources des scores : mteb.