French

MTEB: French est un benchmark consacré à la qualité des plongements de texte en français. Publié en 2024 par Lyon-NLP, avec Ciancone, Kerboua, Schaeffer et Sequeira, ainsi que par la communauté MTEB, il repose sur des jeux de données natifs français de haute qualité.

MTEB: French est un benchmark consacré à la qualité des plongements de texte en français. Publié en 2024 par Lyon-NLP, avec Ciancone, Kerboua, Schaeffer et Sequeira, ainsi que par la communauté MTEB, il repose sur des jeux de données natifs français de haute qualité.

Il évalue les modèles sur plusieurs familles de tâches, notamment la classification, le clustering, le réordonnancement, la recherche et la similarité sémantique. Son rôle est de fournir une mesure synthétique et comparable de la capacité des modèles à produire des représentations textuelles utiles.

Carte d'identité

CaractéristiqueValeur
Éditeur du benchmarkLyon-NLP (Ciancone, Kerboua, Schaeffer, Sequeira) / communaute MTEB
Capacités mesuréesEvalue la qualite des plongements de texte en francais sur 8 categories de taches a partir de jeux de donnees natifs francais de haute qualite.
ModalitéTexte
Type de questionsTaches d'embedding de texte (classification, clustering, pair classification, reranking, retrieval, similarite semantique)
Métrique d'évaluationVariable selon la tache (nDCG@10, accuracy, AP, correlation de Spearman) ; score moyen MTEB
AccèsPublic
LicenceApache-2.0 (cadre MTEB) ; licences des jeux de donnees variables
LanguesFrancais
Année de publication2024
RessourcesSite / dépôt officiel · Article scientifique

Classement des modèles (117)

#ModèleÉditeurLicenceScoreSortieFiabilité
1codefuse-ai/F2LLM-v2-8Bcodefuse-ai🟢 Ouvert72,7 %9 mars 2026✅ Mesuré
2codefuse-ai/F2LLM-v2-14Bcodefuse-ai🟢 Ouvert72,6 %9 mars 2026✅ Mesuré
3codefuse-ai/F2LLM-v2-4Bcodefuse-ai🟢 Ouvert71,2 %9 mars 2026✅ Mesuré
4BAAI/bge-multilingual-gemma2BAAI🟢 Ouvert70,4 %25 juillet 2024✅ Mesuré
5codefuse-ai/F2LLM-v2-1.7Bcodefuse-ai🟢 Ouvert69,9 %9 mars 2026✅ Mesuré
6Alibaba-NLP/gte-Qwen2-7B-instructAlibaba🟢 Ouvert69,0 %15 juin 2024✅ Mesuré
7codefuse-ai/F2LLM-v2-0.6Bcodefuse-ai🟢 Ouvert68,1 %9 mars 2026✅ Mesuré
8Linq-AI-Research/Linq-Embed-MistralLinq-AI-Research🟢 Ouvert68,0 %29 mai 2024✅ Mesuré
9Salesforce/SFR-Embedding-2_RSalesforce🟢 Ouvert67,8 %14 juin 2024✅ Mesuré
10intfloat/e5-mistral-7b-instructIntfloat🟢 Ouvert67,2 %8 février 2024✅ Mesuré
11Salesforce/SFR-Embedding-MistralSalesforce🟢 Ouvert67,2 %24 janvier 2024✅ Mesuré
12Alibaba-NLP/gte-Qwen2-1.5B-instructAlibaba🟢 Ouvert66,1 %29 juillet 2024✅ Mesuré
13codefuse-ai/F2LLM-v2-330Mcodefuse-ai🟢 Ouvert66,0 %9 mars 2026✅ Mesuré
14Alibaba-NLP/gte-Qwen1.5-7B-instructAlibaba🟢 Ouvert65,9 %20 avril 2024✅ Mesuré
15intfloat/multilingual-e5-large-instructIntfloat🟢 Ouvert64,6 %8 février 2024✅ Mesuré
16HIT-TMG/KaLM-embedding-multilingual-mini-instruct-v1.5HIT-TMG🟢 Ouvert63,1 %26 décembre 2024✅ Mesuré
17NovaSearch/stella_en_1.5B_v5NovaSearch🟢 Ouvert62,9 %12 juillet 2024✅ Mesuré
18Cohere/Cohere-embed-multilingual-v3.0Cohere🟢 Ouvert62,8 %2 novembre 2023✅ Mesuré
19Lajavaness/bilingual-embedding-largeLajavaness🟢 Ouvert62,6 %24 juin 2024✅ Mesuré
20codefuse-ai/F2LLM-v2-160Mcodefuse-ai🟢 Ouvert61,9 %9 mars 2026✅ Mesuré
21HIT-TMG/KaLM-embedding-multilingual-mini-instruct-v1HIT-TMG🟢 Ouvert61,8 %23 octobre 2024✅ Mesuré
22codefuse-ai/F2LLM-v2-80Mcodefuse-ai🟢 Ouvert60,3 %9 mars 2026✅ Mesuré
23Snowflake/snowflake-arctic-embed-l-v2.0Snowflake🟢 Ouvert59,4 %4 décembre 2024✅ Mesuré
24Lajavaness/bilingual-embedding-baseLajavaness🟢 Ouvert58,8 %26 juin 2024✅ Mesuré
25Cohere/Cohere-embed-multilingual-light-v3.0Cohere🟢 Ouvert58,5 %2 novembre 2023✅ Mesuré
26deepvk/USER-bge-m3deepvk🟢 Ouvert58,2 %5 juillet 2024✅ Mesuré
27Lajavaness/bilingual-embedding-smallLajavaness🟢 Ouvert58,0 %17 juillet 2024✅ Mesuré
28OrdalieTech/Solon-embeddings-large-0.1OrdalieTech🟢 Ouvert57,0 %9 décembre 2023✅ Mesuré
29NovaSearch/stella_en_400M_v5NovaSearch🟢 Ouvert57,0 %12 juillet 2024✅ Mesuré
30intfloat/multilingual-e5-baseIntfloat🟢 Ouvert56,8 %8 février 2024✅ Mesuré
31OrdalieTech/Solon-embeddings-mini-beta-1.1OrdalieTech🟢 Ouvert56,3 %1 janvier 2025✅ Mesuré
32ibm-granite/granite-embedding-278m-multilingualIBM🟢 Ouvert56,1 %18 décembre 2024✅ Mesuré
33manu/sentence_croissant_alpha_v0.4manu🟢 Ouvert55,7 %27 avril 2024✅ Mesuré
34manu/sentence_croissant_alpha_v0.3manu🟢 Ouvert55,4 %26 avril 2024✅ Mesuré
35ibm-granite/granite-embedding-107m-multilingualIBM🟢 Ouvert55,0 %18 décembre 2024✅ Mesuré
36manu/sentence_croissant_alpha_v0.2manu🟢 Ouvert54,7 %15 mars 2024✅ Mesuré
37manu/bge-m3-custom-frmanu🟢 Ouvert54,6 %11 avril 2024✅ Mesuré
38Cohere/Cohere-embed-english-v3.0Cohere🟢 Ouvert54,5 %2 novembre 2023✅ Mesuré
39sentence-transformers/paraphrase-multilingual-mpnet-base-v2Sentence Transformers🟢 Ouvert54,4 %1 novembre 2019✅ Mesuré
40McGill-NLP/LLM2Vec-Mistral-7B-Instruct-v2-mntp-supervisedMcGill-NLP🟢 Ouvert54,4 %9 avril 2024✅ Mesuré
41Omartificial-Intelligence-Space/Arabic-all-nli-triplet-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert53,3 %14 juin 2024✅ Mesuré
42WhereIsAI/UAE-Large-V1WhereIsAI🟢 Ouvert53,2 %4 décembre 2023✅ Mesuré
43mixedbread-ai/mxbai-embed-large-v1Mixedbread AI🟢 Ouvert53,1 %7 mars 2024✅ Mesuré
44sdadas/mmlw-e5-largesdadas🟢 Ouvert52,6 %17 novembre 2023✅ Mesuré
45Omartificial-Intelligence-Space/Arabic-labse-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert52,5 %16 juin 2024✅ Mesuré
46avsolatorio/GIST-large-Embedding-v0avsolatorio🟢 Ouvert52,4 %14 février 2024✅ Mesuré
47omarelshehy/arabic-english-sts-matryoshkaomarelshehy🟢 Ouvert52,2 %13 octobre 2024✅ Mesuré
48Intfloat: E5-Large-v2Intfloat🟢 Ouvert51,9 %18 novembre 2025✅ Mesuré
49intfloat/e5-largeIntfloat🟢 Ouvert51,7 %26 décembre 2022✅ Mesuré
50BAAI: bge-large-en-v1.5BAAI🟢 Ouvert51,5 %18 novembre 2025✅ Mesuré
51Thenlper: GTE-LargeAlibaba🟢 Ouvert51,5 %18 novembre 2025✅ Mesuré
52Intfloat: E5-Base-v2Intfloat🟢 Ouvert51,1 %18 novembre 2025✅ Mesuré
53sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2Sentence Transformers🟢 Ouvert50,9 %1 novembre 2019✅ Mesuré
54Snowflake/snowflake-arctic-embed-lSnowflake🟢 Ouvert50,9 %12 avril 2024✅ Mesuré
55Cohere/Cohere-embed-english-light-v3.0Cohere🟢 Ouvert50,6 %2 novembre 2023✅ Mesuré
56nomic-ai/nomic-embed-text-v1-unsupervisedNomic AI🟢 Ouvert50,5 %15 janvier 2024✅ Mesuré
57infgrad/stella-base-en-v2infgrad🟢 Ouvert50,3 %19 octobre 2023✅ Mesuré
58dwzhu/e5-base-4kdwzhu🟢 Ouvert49,7 %28 mars 2024✅ Mesuré
59sentence-transformers/LaBSESentence Transformers🟢 Ouvert49,6 %1 novembre 2019✅ Mesuré
60Omartificial-Intelligence-Space/Arabic-MiniLM-L12-v2-all-nli-tripletOmartificial-Intelligence-Space🟢 Ouvert49,6 %25 juin 2024✅ Mesuré
61Thenlper: GTE-BaseAlibaba🟢 Ouvert49,6 %18 novembre 2025✅ Mesuré
62ibm-granite/granite-embedding-125m-englishIBM🟢 Ouvert49,5 %18 décembre 2024✅ Mesuré
63sdadas/mmlw-roberta-largesdadas🟢 Ouvert49,5 %17 novembre 2023✅ Mesuré
64intfloat/e5-baseIntfloat🟢 Ouvert49,3 %26 décembre 2022✅ Mesuré
65BAAI: bge-base-en-v1.5BAAI🟢 Ouvert49,2 %18 novembre 2025✅ Mesuré
66thenlper/gte-smallAlibaba🟢 Ouvert49,1 %27 juillet 2023✅ Mesuré
67avsolatorio/GIST-Embedding-v0avsolatorio🟢 Ouvert49,1 %31 janvier 2024✅ Mesuré
68nomic-ai/nomic-embed-text-v1Nomic AI🟢 Ouvert49,0 %31 janvier 2024✅ Mesuré
69BAAI/bge-small-en-v1.5BAAI🟢 Ouvert48,5 %12 septembre 2023✅ Mesuré
70deepfile/embedder-100pdeepfile🟢 Ouvert48,3 %24 juillet 2023✅ Mesuré
71intfloat/e5-smallIntfloat🟢 Ouvert48,1 %8 février 2024✅ Mesuré
72Snowflake/snowflake-arctic-embed-sSnowflake🟢 Ouvert48,1 %12 avril 2024✅ Mesuré
73bigscience/sgpt-bloom-7b1-msmarcobigscience🟢 Ouvert48,0 %26 août 2022✅ Mesuré
74intfloat/e5-small-v2Intfloat🟢 Ouvert47,7 %8 février 2024✅ Mesuré
75abhinand/MedEmbed-small-v0.1abhinand🟢 Ouvert47,4 %20 octobre 2024✅ Mesuré
76sdadas/mmlw-e5-basesdadas🟢 Ouvert47,3 %17 novembre 2023✅ Mesuré
77Mihaiii/IvysaurMihaiii🟢 Ouvert47,3 %27 avril 2024✅ Mesuré
78avsolatorio/GIST-small-Embedding-v0avsolatorio🟢 Ouvert47,2 %3 février 2024✅ Mesuré
79Snowflake/snowflake-arctic-embed-m-v1.5Snowflake🟢 Ouvert47,2 %8 juillet 2024✅ Mesuré
80Snowflake/snowflake-arctic-embed-mSnowflake🟢 Ouvert46,5 %12 avril 2024✅ Mesuré
81sentence-transformers/static-similarity-mrl-multilingual-v1Sentence Transformers🟢 Ouvert46,2 %15 janvier 2025✅ Mesuré
82avsolatorio/GIST-all-MiniLM-L6-v2avsolatorio🟢 Ouvert46,2 %3 février 2024✅ Mesuré
83sdadas/mmlw-e5-smallsdadas🟢 Ouvert45,8 %17 novembre 2023✅ Mesuré
84nomic-ai/nomic-embed-text-v1.5Nomic AI🟢 Ouvert45,6 %10 février 2024✅ Mesuré
85ibm-granite/granite-embedding-30m-englishIBM🟢 Ouvert45,3 %18 décembre 2024✅ Mesuré
86Sentence Transformers: all-MiniLM-L6-v2Sentence Transformers🟢 Ouvert45,2 %17 novembre 2025✅ Mesuré
87brahmairesearch/slx-v0.1brahmairesearch🟢 Ouvert45,2 %13 août 2024✅ Mesuré
88sdadas/mmlw-roberta-basesdadas🟢 Ouvert44,4 %17 novembre 2023✅ Mesuré
89Snowflake/snowflake-arctic-embed-xsSnowflake🟢 Ouvert43,9 %8 juillet 2024✅ Mesuré
90McGill-NLP/LLM2Vec-Mistral-7B-Instruct-v2-mntp-unsup-simcseMcGill-NLP🟢 Ouvert43,7 %9 avril 2024✅ Mesuré
91Mihaiii/gte-micro-v4Mihaiii🟢 Ouvert43,6 %22 avril 2024✅ Mesuré
92Mihaiii/BulbasaurMihaiii🟢 Ouvert42,9 %27 avril 2024✅ Mesuré
93sergeyzh/LaBSE-ru-turbosergeyzh🟢 Ouvert42,6 %27 juin 2024✅ Mesuré
94izhx/udever-bloom-1b1izhx🟢 Ouvert42,2 %24 octobre 2023✅ Mesuré
95Mihaiii/WartortleMihaiii🟢 Ouvert41,8 %30 avril 2024✅ Mesuré
96Mihaiii/VenusaurMihaiii🟢 Ouvert41,6 %29 avril 2024✅ Mesuré
97cointegrated/LaBSE-en-rucointegrated🟢 Ouvert41,0 %10 juin 2021✅ Mesuré
98Mihaiii/SquirtleMihaiii🟢 Ouvert40,8 %30 avril 2024✅ Mesuré
99aari1995/German_Semantic_STS_V2aari1995🟢 Ouvert39,8 %17 novembre 2022✅ Mesuré
100ai-forever/ru-en-RoSBERTaai-forever🟢 Ouvert39,1 %29 juillet 2024✅ Mesuré
101Mihaiii/gte-microMihaiii🟢 Ouvert37,7 %21 avril 2024✅ Mesuré
102deepvk/USER-basedeepvk🟢 Ouvert37,3 %10 juin 2024✅ Mesuré
103consciousAI/cai-lunaris-text-embeddingsconsciousAI🟢 Ouvert35,6 %22 juin 2023✅ Mesuré
104DeepPavlov/rubert-base-cased-sentenceDeepPavlov🟢 Ouvert31,7 %4 mars 2020✅ Mesuré
105cointegrated/rubert-tinycointegrated🟢 Ouvert31,3 %24 mai 2021✅ Mesuré
106Omartificial-Intelligence-Space/Arabic-mpnet-base-all-nli-tripletOmartificial-Intelligence-Space🟢 Ouvert31,1 %15 juin 2024✅ Mesuré
107sergeyzh/rubert-tiny-turbosergeyzh🟢 Ouvert30,4 %21 juin 2024✅ Mesuré
108silma-ai/silma-embeddding-matryoshka-v0.1silma-ai🟢 Ouvert30,1 %12 octobre 2024✅ Mesuré
109Omartificial-Intelligence-Space/Marbert-all-nli-triplet-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert29,6 %17 juin 2024✅ Mesuré
110Omartificial-Intelligence-Space/Arabert-all-nli-triplet-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert29,4 %16 juin 2024✅ Mesuré
111cointegrated/rubert-tiny2cointegrated🟢 Ouvert29,0 %28 octobre 2021✅ Mesuré
112DeepPavlov/rubert-base-casedDeepPavlov🟢 Ouvert29,0 %4 mars 2020✅ Mesuré
113izhx/udever-bloom-560mizhx🟢 Ouvert28,8 %24 octobre 2023✅ Mesuré
114DeepPavlov/distilrubert-small-cased-conversationalDeepPavlov🟢 Ouvert28,2 %28 juin 2022✅ Mesuré
115ai-forever/sbert_large_nlu_ruai-forever🟢 Ouvert26,9 %20 novembre 2020✅ Mesuré
116ai-forever/sbert_large_mt_nlu_ruai-forever🟢 Ouvert26,2 %18 mai 2021✅ Mesuré
117deepvk/deberta-v1-basedeepvk🟢 Ouvert26,0 %7 février 2023✅ Mesuré

Classement établi sur 117 modèles évalués. Score médian de l'ensemble : 49,6 %.

Notre analyse

Un score élevé sur MTEB: French traduit une bonne qualité globale des plongements sur les différentes catégories couvertes. L’interprétation doit toutefois tenir compte de l’hétérogénéité des métriques, parmi lesquelles nDCG@10, accuracy, AP et corrélation de Spearman. Le score moyen MTEB agrège donc des performances issues de tâches distinctes, plutôt qu’une aptitude unique.

La base réunit 117 modèles, avec un score médian de 50 %. codefuse-ai/F2LLM-v2-8B occupe la première place à 73 %, ce qui met en évidence un écart notable entre le meilleur résultat et le niveau central de l’ensemble. Ce classement révèle ainsi une différenciation substantielle entre les modèles évalués, sans indiquer une saturation au sommet.

La portée reste centrée sur les embeddings de textes français et sur les catégories de tâches intégrées au cadre. La fiabilité demande également de la prudence, car les scores sont majoritairement auto-déclarés par les éditeurs plutôt que produits dans le cadre d’une mesure indépendante uniforme.


Sources des scores : mteb.