BEIR

MTEB: BEIR est un benchmark créé par Nandan Thakur et al. en 2021 pour évaluer la recherche d’information zero-shot. Il confronte les modèles à des requêtes associées à des corpus de documents qu’ils doivent classer, dans un ensemble hétérogène de tâches et de domaines.

MTEB: BEIR est un benchmark créé par Nandan Thakur et al. en 2021 pour évaluer la recherche d’information zero-shot. Il confronte les modèles à des requêtes associées à des corpus de documents qu’ils doivent classer, dans un ensemble hétérogène de tâches et de domaines.

Intégré au cadre d’évaluation MTEB, il fournit une base commune pour comparer la qualité de modèles de recherche fondés sur le traitement automatique du langage. Cette diversité vise à mesurer leur capacité de généralisation au-delà d’un domaine ou d’un type de requête unique.

Carte d'identité

CaractéristiqueValeur
Éditeur du benchmarkNandan Thakur et al.
Capacités mesuréesMesure la capacité d’un modèle à effectuer de la recherche d’information zero-shot sur des domaines et types de requêtes variés.
ModalitéTexte
Type de questionsrequêtes de recherche d’information avec corpus de documents à classer
Métrique d'évaluationnDCG@10
AccèsPublic
Languesanglais
Taille du jeu18 jeux de données de recherche d’information, avec des corpus et nombres de requêtes variables
Année de publication2021
RessourcesSite / dépôt officiel · Article scientifique

Métadonnées descriptives pré-renseignées automatiquement, en cours de relecture éditoriale.

Classement des modèles (191)

#ModèleÉditeurLicenceScoreSortieFiabilité
1voyageai/voyage-3-m-expVoyage AI🟢 Ouvert68,1 %8 janvier 2025✅ Mesuré
2TencentBAC/Conan-embedding-v2Tencent🟢 Ouvert66,4 %10 avril 2025✅ Mesuré
3nvidia/NV-Embed-v2NVIDIA🟢 Ouvert63,2 %9 septembre 2024✅ Mesuré
4Qwen: Qwen3 Embedding 8BAlibaba Cloud / Qwen Team🟢 Ouvert62,8 %28 octobre 2025✅ Mesuré
5BAAI/bge-en-iclBAAI🟢 Ouvert62,2 %25 juillet 2024✅ Mesuré
6yibinlei/LENS-d8000yibinlei🟢 Ouvert61,9 %17 janvier 2025✅ Mesuré
7infly/inf-retriever-v1infly🟢 Ouvert61,7 %24 décembre 2024✅ Mesuré
8Qwen: Qwen3 Embedding 4BAlibaba Cloud / Qwen Team🟢 Ouvert61,6 %28 octobre 2025✅ Mesuré
9yibinlei/LENS-d4000yibinlei🟢 Ouvert60,8 %17 janvier 2025✅ Mesuré
10Linq-AI-Research/Linq-Embed-MistralLinq-AI-Research🟢 Ouvert60,2 %29 mai 2024✅ Mesuré
11Salesforce/SFR-Embedding-2_RSalesforce🟢 Ouvert59,8 %14 juin 2024✅ Mesuré
12zeta-alpha-ai/Zeta-Alpha-E5-Mistralzeta-alpha-ai🟢 Ouvert59,5 %30 août 2024✅ Mesuré
13NovaSearch/stella_en_1.5B_v5NovaSearch🟢 Ouvert59,3 %12 juillet 2024✅ Mesuré
14BAAI/bge-multilingual-gemma2BAAI🟢 Ouvert59,2 %25 juillet 2024✅ Mesuré
15Salesforce/SFR-Embedding-MistralSalesforce🟢 Ouvert59,1 %24 janvier 2024✅ Mesuré
16Alibaba-NLP/gte-Qwen2-7B-instructAlibaba🟢 Ouvert58,9 %15 juin 2024✅ Mesuré
17BeastyZ/e5-R-mistral-7bBeastyZ🟢 Ouvert58,6 %28 juin 2024✅ Mesuré
18openbmb/MiniCPM-EmbeddingOpenBMB🟢 Ouvert58,6 %4 septembre 2024✅ Mesuré
19infly/inf-retriever-v1-1.5binfly🟢 Ouvert58,4 %8 février 2025✅ Mesuré
20Alibaba-NLP/gte-Qwen2-1.5B-instructAlibaba🟢 Ouvert58,3 %29 juillet 2024✅ Mesuré
21codefuse-ai/F2LLM-v2-14Bcodefuse-ai🟢 Ouvert58,3 %9 mars 2026✅ Mesuré
22NovaSearch/stella_en_400M_v5NovaSearch🟢 Ouvert57,9 %12 juillet 2024✅ Mesuré
23codefuse-ai/F2LLM-v2-8Bcodefuse-ai🟢 Ouvert57,5 %9 mars 2026✅ Mesuré
24lightonai/LateOnlightonai🟢 Ouvert57,2 %21 avril 2026✅ Mesuré
25intfloat/e5-mistral-7b-instructIntfloat🟢 Ouvert57,1 %8 février 2024✅ Mesuré
26codefuse-ai/F2LLM-v2-4Bcodefuse-ai🟢 Ouvert56,9 %9 mars 2026✅ Mesuré
27McGill-NLP/LLM2Vec-Meta-Llama-3-8B-Instruct-mntp-supervisedMcGill-NLP🟢 Ouvert56,6 %9 avril 2024✅ Mesuré
28Alibaba-NLP/gte-Qwen1.5-7B-instructAlibaba🟢 Ouvert56,2 %20 avril 2024✅ Mesuré
29lightonai/DenseOnlightonai🟢 Ouvert56,2 %21 avril 2026✅ Mesuré
30McGill-NLP/LLM2Vec-Mistral-7B-Instruct-v2-mntp-supervisedMcGill-NLP🟢 Ouvert56,0 %9 avril 2024✅ Mesuré
31Snowflake/snowflake-arctic-embed-lSnowflake🟢 Ouvert56,0 %12 avril 2024✅ Mesuré
32google/text-embedding-005Google🟢 Ouvert55,8 %18 novembre 2024✅ Mesuré
33Alibaba-NLP/gme-Qwen2-VL-7B-InstructAlibaba🟢 Ouvert55,7 %24 décembre 2024✅ Mesuré
34Qwen: Qwen3 Embedding 0.6BAlibaba Cloud / Qwen Team🟢 Ouvert55,5 %5 novembre 2025✅ Mesuré
35Snowflake/snowflake-arctic-embed-m-v2.0Snowflake🟢 Ouvert55,5 %4 décembre 2024✅ Mesuré
36google/text-embedding-004Google🟢 Ouvert55,5 %14 mai 2024✅ Mesuré
37openai/text-embedding-3-largeOpenAI🟢 Ouvert55,4 %25 janvier 2024✅ Mesuré
38lightonai/ColBERT-Zerolightonai🟢 Ouvert55,4 %19 février 2026✅ Mesuré
39Snowflake/snowflake-arctic-embed-l-v2.0Snowflake🟢 Ouvert55,2 %4 décembre 2024✅ Mesuré
40Alibaba-NLP/gte-modernbert-baseAlibaba🟢 Ouvert55,2 %21 janvier 2025✅ Mesuré
41Snowflake/snowflake-arctic-embed-m-v1.5Snowflake🟢 Ouvert55,2 %8 juillet 2024✅ Mesuré
42GritLM/GritLM-8x7BGritLM🟢 Ouvert55,1 %15 février 2024✅ Mesuré
43KaLM-Embedding/KaLM-embedding-multilingual-mini-instruct-v2.5KaLM-Embedding🟢 Ouvert55,0 %30 septembre 2025✅ Mesuré
44Snowflake/snowflake-arctic-embed-mSnowflake🟢 Ouvert54,9 %12 avril 2024✅ Mesuré
45Snowflake/snowflake-arctic-embed-m-longSnowflake🟢 Ouvert54,8 %12 avril 2024✅ Mesuré
46lightonai/GTE-ModernColBERT-v1lightonai🟢 Ouvert54,8 %30 avril 2025✅ Mesuré
47WhereIsAI/UAE-Large-V1WhereIsAI🟢 Ouvert54,6 %4 décembre 2023✅ Mesuré
48McGill-NLP/LLM2Vec-Llama-2-7b-chat-hf-mntp-supervisedMcGill-NLP🟢 Ouvert54,6 %9 avril 2024✅ Mesuré
49BAAI: bge-large-en-v1.5BAAI🟢 Ouvert54,3 %18 novembre 2025✅ Mesuré
50manveertamber/cadet-embed-base-v1manveertamber🟢 Ouvert54,3 %11 mai 2025✅ Mesuré
51mixedbread-ai/mxbai-embed-large-v1Mixedbread AI🟢 Ouvert54,3 %7 mars 2024✅ Mesuré
52jxm/cde-small-v2jxm🟢 Ouvert54,2 %13 janvier 2025✅ Mesuré
53codefuse-ai/F2LLM-v2-1.7Bcodefuse-ai🟢 Ouvert54,1 %9 mars 2026✅ Mesuré
54Alibaba-NLP/gte-base-en-v1.5Alibaba🟢 Ouvert54,1 %20 juin 2024✅ Mesuré
55BAAI/bge-large-enBAAI🟢 Ouvert53,9 %5 août 2023✅ Mesuré
56MongoDB/mdbr-leaf-irMongoDB🟢 Ouvert53,5 %27 août 2025✅ Mesuré
57avsolatorio/GIST-large-Embedding-v0avsolatorio🟢 Ouvert53,4 %14 février 2024✅ Mesuré
58Alibaba-NLP/gme-Qwen2-VL-2B-InstructAlibaba🟢 Ouvert53,4 %24 décembre 2024✅ Mesuré
59w601sxs/b1ade-embedw601sxs🟢 Ouvert53,3 %10 mars 2025✅ Mesuré
60jxm/cde-small-v1jxm🟢 Ouvert53,3 %24 septembre 2024✅ Mesuré
61BAAI: bge-base-en-v1.5BAAI🟢 Ouvert53,2 %18 novembre 2025✅ Mesuré
62jinaai/jina-embeddings-v3Jina AI🟢 Ouvert53,2 %18 septembre 2024✅ Mesuré
63ibm-granite/granite-embedding-english-r2IBM🟢 Ouvert53,1 %15 août 2025✅ Mesuré
64BAAI/bge-base-enBAAI🟢 Ouvert53,0 %5 août 2023✅ Mesuré
65nomic-ai/nomic-embed-text-v1Nomic AI🟢 Ouvert52,9 %31 janvier 2024✅ Mesuré
66nomic-ai/modernbert-embed-baseNomic AI🟢 Ouvert52,9 %29 décembre 2024✅ Mesuré
67intfloat/multilingual-e5-large-instructIntfloat🟢 Ouvert52,7 %8 février 2024✅ Mesuré
68opensearch-project/opensearch-neural-sparse-encoding-doc-v3-gteopensearch-project🟢 Ouvert52,7 %18 juin 2025✅ Mesuré
69ibm-granite/granite-embedding-125m-englishIBM🟢 Ouvert52,3 %18 décembre 2024✅ Mesuré
70avsolatorio/GIST-Embedding-v0avsolatorio🟢 Ouvert52,3 %31 janvier 2024✅ Mesuré
71Thenlper: GTE-LargeAlibaba🟢 Ouvert52,2 %18 novembre 2025✅ Mesuré
72avsolatorio/NoInstruct-small-Embedding-v0avsolatorio🟢 Ouvert52,0 %1 mai 2024✅ Mesuré
73Snowflake/snowflake-arctic-embed-sSnowflake🟢 Ouvert52,0 %12 avril 2024✅ Mesuré
74llmrails/ember-v1llmrails🟢 Ouvert51,9 %10 octobre 2023✅ Mesuré
75lightonai/ColBERT-Zero-supervisedlightonai🟢 Ouvert51,9 %19 février 2026✅ Mesuré
76HIT-TMG/KaLM-embedding-multilingual-mini-instruct-v1HIT-TMG🟢 Ouvert51,9 %23 octobre 2024✅ Mesuré
77nomic-ai/nomic-embed-text-v1.5Nomic AI🟢 Ouvert51,8 %10 février 2024✅ Mesuré
78BAAI/bge-small-enBAAI🟢 Ouvert51,8 %5 août 2023✅ Mesuré
79HIT-TMG/KaLM-embedding-multilingual-mini-instruct-v2HIT-TMG🟢 Ouvert51,7 %25 juin 2025✅ Mesuré
80BAAI/bge-small-en-v1.5BAAI🟢 Ouvert51,7 %12 septembre 2023✅ Mesuré
81HIT-TMG/KaLM-embedding-multilingual-mini-instruct-v1.5HIT-TMG🟢 Ouvert51,6 %26 décembre 2024✅ Mesuré
82Intfloat: Multilingual-E5-LargeIntfloat🟢 Ouvert51,5 %18 novembre 2025✅ Mesuré
83McGill-NLP/LLM2Vec-Sheared-LLaMA-mntp-supervisedMcGill-NLP🟢 Ouvert51,4 %9 avril 2024✅ Mesuré
84nomic-ai/nomic-embed-text-v1-ablatedNomic AI🟢 Ouvert51,4 %15 janvier 2024✅ Mesuré
85mixedbread-ai/mxbai-embed-2d-large-v1Mixedbread AI🟢 Ouvert51,4 %4 mars 2024✅ Mesuré
86codefuse-ai/F2LLM-v2-0.6Bcodefuse-ai🟢 Ouvert51,4 %9 mars 2026✅ Mesuré
87lightonai/ColBERT-Zero-unsupervisedlightonai🟢 Ouvert51,3 %19 février 2026✅ Mesuré
88amazon/Titan-text-embeddings-v2Amazon🟢 Ouvert51,3 %30 avril 2024✅ Mesuré
89Thenlper: GTE-BaseAlibaba🟢 Ouvert51,1 %18 novembre 2025✅ Mesuré
90openai/text-embedding-3-smallOpenAI🟢 Ouvert51,1 %25 janvier 2024✅ Mesuré
91Alibaba-NLP/gte-multilingual-baseAlibaba🟢 Ouvert51,1 %20 juillet 2024✅ Mesuré
92ibm-granite/granite-embedding-small-english-r2IBM🟢 Ouvert50,9 %15 août 2025✅ Mesuré
93HIT-TMG/KaLM-embedding-multilingual-mini-v1HIT-TMG🟢 Ouvert50,8 %27 août 2024✅ Mesuré
94Intfloat: E5-Large-v2Intfloat🟢 Ouvert50,6 %18 novembre 2025✅ Mesuré
95avsolatorio/GIST-small-Embedding-v0avsolatorio🟢 Ouvert50,4 %3 février 2024✅ Mesuré
96Intfloat: E5-Base-v2Intfloat🟢 Ouvert50,3 %18 novembre 2025✅ Mesuré
97dwzhu/e5-base-4kdwzhu🟢 Ouvert50,3 %28 mars 2024✅ Mesuré
98Snowflake/snowflake-arctic-embed-xsSnowflake🟢 Ouvert50,1 %8 juillet 2024✅ Mesuré
99lightonai/LateOn-unsupervisedlightonai🟢 Ouvert50,1 %21 avril 2026✅ Mesuré
100infgrad/stella-base-en-v2infgrad🟢 Ouvert50,0 %19 octobre 2023✅ Mesuré
101opensearch-project/opensearch-neural-sparse-encoding-doc-v3-distillopensearch-project🟢 Ouvert50,0 %28 mars 2025✅ Mesuré
102intfloat/e5-largeIntfloat🟢 Ouvert50,0 %26 décembre 2022✅ Mesuré
103codefuse-ai/F2LLM-v2-330Mcodefuse-ai🟢 Ouvert49,9 %9 mars 2026✅ Mesuré
104thenlper/gte-smallAlibaba🟢 Ouvert49,5 %27 juillet 2023✅ Mesuré
105izhx/udever-bloom-7b1izhx🟢 Ouvert49,3 %24 octobre 2023✅ Mesuré
106ibm-granite/granite-embedding-311m-multilingual-r2IBM🟢 Ouvert49,3 %29 avril 2026✅ Mesuré
107openai/text-embedding-ada-002OpenAI🟢 Ouvert49,2 %15 décembre 2022✅ Mesuré
108ibm-granite/granite-embedding-30m-englishIBM🟢 Ouvert49,1 %18 décembre 2024✅ Mesuré
109lightonai/DenseOn-unsupervisedlightonai🟢 Ouvert49,1 %21 avril 2026✅ Mesuré
110intfloat/e5-small-v2Intfloat🟢 Ouvert49,0 %8 février 2024✅ Mesuré
111intfloat/multilingual-e5-baseIntfloat🟢 Ouvert48,9 %8 février 2024✅ Mesuré
112opensearch-project/opensearch-neural-sparse-encoding-doc-v2-distillopensearch-project🟢 Ouvert48,8 %17 juillet 2024✅ Mesuré
113intfloat/e5-baseIntfloat🟢 Ouvert48,7 %26 décembre 2022✅ Mesuré
114ibm-granite/granite-embedding-278m-multilingualIBM🟢 Ouvert48,2 %18 décembre 2024✅ Mesuré
115opensearch-project/opensearch-neural-sparse-encoding-doc-v2-miniopensearch-project🟢 Ouvert48,1 %18 juillet 2024✅ Mesuré
116nomic-ai/nomic-embed-text-v1-unsupervisedNomic AI🟢 Ouvert48,0 %15 janvier 2024✅ Mesuré
117izhx/udever-bloom-3bizhx🟢 Ouvert47,7 %24 octobre 2023✅ Mesuré
118ibm-granite/granite-embedding-97m-multilingual-r2IBM🟢 Ouvert47,3 %29 avril 2026✅ Mesuré
119OrdalieTech/Solon-embeddings-large-0.1OrdalieTech🟢 Ouvert47,3 %9 décembre 2023✅ Mesuré
120intfloat/multilingual-e5-smallIntfloat🟢 Ouvert46,7 %8 février 2024✅ Mesuré
121codefuse-ai/F2LLM-v2-160Mcodefuse-ai🟢 Ouvert46,5 %9 mars 2026✅ Mesuré
122intfloat/e5-smallIntfloat🟢 Ouvert46,0 %8 février 2024✅ Mesuré
123ibm-granite/granite-embedding-107m-multilingualIBM🟢 Ouvert45,3 %18 décembre 2024✅ Mesuré
124izhx/udever-bloom-1b1izhx🟢 Ouvert45,3 %24 octobre 2023✅ Mesuré
125jinaai/jina-embeddings-v2-base-enJina AI🟢 Ouvert45,3 %27 septembre 2023✅ Mesuré
126jinaai/jina-embeddings-v2-small-enJina AI🟢 Ouvert45,1 %27 septembre 2023✅ Mesuré
127avsolatorio/GIST-all-MiniLM-L6-v2avsolatorio🟢 Ouvert45,1 %3 février 2024✅ Mesuré
128codefuse-ai/F2LLM-v2-80Mcodefuse-ai🟢 Ouvert44,9 %9 mars 2026✅ Mesuré
129sentence-transformers/gtr-t5-baseSentence Transformers🟢 Ouvert44,7 %9 février 2022✅ Mesuré
130jinaai/jina-embedding-b-en-v1Jina AI🟢 Ouvert44,0 %7 juillet 2023✅ Mesuré
131Mihaiii/IvysaurMihaiii🟢 Ouvert44,0 %27 avril 2024✅ Mesuré
132Sentence Transformers: all-mpnet-base-v2Sentence Transformers🟢 Ouvert43,8 %17 novembre 2025✅ Mesuré
133Lajavaness/bilingual-embedding-baseLajavaness🟢 Ouvert43,8 %26 juin 2024✅ Mesuré
134mixedbread-ai/mxbai-embed-xsmall-v1Mixedbread AI🟢 Ouvert42,8 %13 août 2024✅ Mesuré
135Sentence Transformers: all-MiniLM-L12-v2Sentence Transformers🟢 Ouvert42,7 %18 novembre 2025✅ Mesuré
136brahmairesearch/slx-v0.1brahmairesearch🟢 Ouvert42,0 %13 août 2024✅ Mesuré
137Sentence Transformers: all-MiniLM-L6-v2Sentence Transformers🟢 Ouvert41,9 %17 novembre 2025✅ Mesuré
138izhx/udever-bloom-560mizhx🟢 Ouvert41,2 %24 octobre 2023✅ Mesuré
139ai-forever/ru-en-RoSBERTaai-forever🟢 Ouvert39,3 %29 juillet 2024✅ Mesuré
140Mihaiii/gte-micro-v4Mihaiii🟢 Ouvert39,2 %22 avril 2024✅ Mesuré
141sdadas/mmlw-roberta-basesdadas🟢 Ouvert39,2 %17 novembre 2023✅ Mesuré
142McGill-NLP/LLM2Vec-Meta-Llama-3-8B-Instruct-mntp-unsup-simcseMcGill-NLP🟢 Ouvert39,2 %9 avril 2024✅ Mesuré
143sdadas/mmlw-e5-basesdadas🟢 Ouvert39,2 %17 novembre 2023✅ Mesuré
144jinaai/jina-embedding-s-en-v1Jina AI🟢 Ouvert38,9 %7 juillet 2023✅ Mesuré
145deepfile/embedder-100pdeepfile🟢 Ouvert38,7 %24 juillet 2023✅ Mesuré
146McGill-NLP/LLM2Vec-Mistral-7B-Instruct-v2-mntp-unsup-simcseMcGill-NLP🟢 Ouvert38,1 %9 avril 2024✅ Mesuré
147Mihaiii/BulbasaurMihaiii🟢 Ouvert37,3 %27 avril 2024✅ Mesuré
148sdadas/mmlw-e5-largesdadas🟢 Ouvert37,0 %17 novembre 2023✅ Mesuré
149Hum-Works/lodestone-base-4096-v1Hum-Works🟢 Ouvert37,0 %25 août 2023✅ Mesuré
150McGill-NLP/LLM2Vec-Llama-2-7b-chat-hf-mntp-unsup-simcseMcGill-NLP🟢 Ouvert36,7 %9 avril 2024✅ Mesuré
151sdadas/mmlw-roberta-largesdadas🟢 Ouvert35,8 %17 novembre 2023✅ Mesuré
152sentence-transformers/paraphrase-multilingual-mpnet-base-v2Sentence Transformers🟢 Ouvert35,3 %1 novembre 2019✅ Mesuré
153sergeyzh/LaBSE-ru-turbosergeyzh🟢 Ouvert34,6 %27 juin 2024✅ Mesuré
154sentence-transformers/static-retrieval-mrl-en-v1Sentence Transformers🟢 Ouvert34,1 %24 octobre 2024✅ Mesuré
155sentence-transformers/sentence-t5-baseSentence Transformers🟢 Ouvert33,6 %9 février 2022✅ Mesuré
156sdadas/mmlw-e5-smallsdadas🟢 Ouvert33,5 %17 novembre 2023✅ Mesuré
157sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2Sentence Transformers🟢 Ouvert33,4 %1 novembre 2019✅ Mesuré
158Omartificial-Intelligence-Space/Arabic-all-nli-triplet-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert32,1 %14 juin 2024✅ Mesuré
159minishlab/potion-base-8Mminishlab🟢 Ouvert30,4 %29 octobre 2024✅ Mesuré
160Mihaiii/WartortleMihaiii🟢 Ouvert29,3 %30 avril 2024✅ Mesuré
161sentence-transformers/static-similarity-mrl-multilingual-v1Sentence Transformers🟢 Ouvert28,3 %15 janvier 2025✅ Mesuré
162Mihaiii/gte-microMihaiii🟢 Ouvert28,1 %21 avril 2024✅ Mesuré
163minishlab/M2V_base_gloveminishlab🟢 Ouvert28,0 %21 septembre 2024✅ Mesuré
164Omartificial-Intelligence-Space/Arabic-MiniLM-L12-v2-all-nli-tripletOmartificial-Intelligence-Space🟢 Ouvert27,9 %25 juin 2024✅ Mesuré
165minishlab/potion-base-4Mminishlab🟢 Ouvert27,9 %29 octobre 2024✅ Mesuré
166minishlab/M2V_base_glove_subwordminishlab🟢 Ouvert26,2 %21 septembre 2024✅ Mesuré
167Mihaiii/SquirtleMihaiii🟢 Ouvert26,2 %30 avril 2024✅ Mesuré
168McGill-NLP/LLM2Vec-Sheared-LLaMA-mntp-unsup-simcseMcGill-NLP🟢 Ouvert25,9 %9 avril 2024✅ Mesuré
169Mihaiii/VenusaurMihaiii🟢 Ouvert25,5 %29 avril 2024✅ Mesuré
170minishlab/M2V_base_outputminishlab🟢 Ouvert25,1 %21 septembre 2024✅ Mesuré
171shibing624/text2vec-base-multilingualshibing624🟢 Ouvert24,7 %22 juin 2023✅ Mesuré
172Gameselo/STS-multilingual-mpnet-base-v2Gameselo🟢 Ouvert24,5 %7 juin 2024✅ Mesuré
173deepvk/USER-basedeepvk🟢 Ouvert23,2 %10 juin 2024✅ Mesuré
174Omartificial-Intelligence-Space/Arabic-labse-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert23,2 %16 juin 2024✅ Mesuré
175minishlab/potion-base-2Mminishlab🟢 Ouvert22,9 %29 octobre 2024✅ Mesuré
176sentence-transformers/LaBSESentence Transformers🟢 Ouvert19,0 %1 novembre 2019✅ Mesuré
177aari1995/German_Semantic_STS_V2aari1995🟢 Ouvert17,9 %17 novembre 2022✅ Mesuré
178sergeyzh/rubert-tiny-turbosergeyzh🟢 Ouvert17,6 %21 juin 2024✅ Mesuré
179cointegrated/LaBSE-en-rucointegrated🟢 Ouvert17,3 %10 juin 2021✅ Mesuré
180omarelshehy/arabic-english-sts-matryoshkaomarelshehy🟢 Ouvert16,3 %13 octobre 2024✅ Mesuré
181facebook/SONARMeta🟢 Ouvert13,5 %21 mai 2021✅ Mesuré
182cointegrated/rubert-tiny2cointegrated🟢 Ouvert10,6 %28 octobre 2021✅ Mesuré
183Omartificial-Intelligence-Space/Arabic-mpnet-base-all-nli-tripletOmartificial-Intelligence-Space🟢 Ouvert10,1 %15 juin 2024✅ Mesuré
184silma-ai/silma-embeddding-matryoshka-v0.1silma-ai🟢 Ouvert9,0 %12 octobre 2024✅ Mesuré
185DeepPavlov/distilrubert-small-cased-conversationalDeepPavlov🟢 Ouvert8,4 %28 juin 2022✅ Mesuré
186Omartificial-Intelligence-Space/Arabert-all-nli-triplet-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert8,4 %16 juin 2024✅ Mesuré
187cointegrated/rubert-tinycointegrated🟢 Ouvert8,4 %24 mai 2021✅ Mesuré
188Omartificial-Intelligence-Space/Marbert-all-nli-triplet-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert7,3 %17 juin 2024✅ Mesuré
189DeepPavlov/rubert-base-cased-sentenceDeepPavlov🟢 Ouvert5,3 %4 mars 2020✅ Mesuré
190DeepPavlov/rubert-base-casedDeepPavlov🟢 Ouvert4,6 %4 mars 2020✅ Mesuré
191deepvk/deberta-v1-basedeepvk🟢 Ouvert4,6 %7 février 2023✅ Mesuré

Classement établi sur 191 modèles évalués, dont 8 de grands éditeurs. Score médian de l'ensemble : 50,3 %.

Notre analyse

Un score nDCG@10 élevé indique que le modèle place plus efficacement les documents pertinents parmi les dix premiers résultats. Le classement fait apparaître un écart notable entre la médiane de 50 % des 191 modèles évalués et les 68 % de voyageai/voyage-3-m-exp, développé par Voyage AI. Cet écart montre que le benchmark conserve une capacité de différenciation et ne paraît pas saturé au sommet.

La comparaison doit néanmoins être interprétée avec prudence, car les scores sont majoritairement auto-déclarés par les éditeurs plutôt que produits dans le cadre d’une mesure indépendante uniforme. Le caractère public du benchmark peut aussi accroître le risque que ses contenus aient été exposés durant le développement des modèles, ce qui peut affecter la portée de l’évaluation zero-shot. Enfin, MTEB: BEIR mesure spécifiquement la recherche d’information en anglais. Sa variété de corpus, de domaines et de requêtes renforce sa pertinence pour ce cadre, mais les résultats décrivent avant tout la qualité du classement documentaire sur ces tâches.


Sources des scores : mteb.