Legal

MTEB: Legal est un benchmark public créé par MTEB / MMTEB (embeddings-benchmark) pour évaluer la recherche de documents juridiques dans plusieurs langues. Il couvre notamment la jurisprudence, les statuts, les questions-réponses juridiques et le résumé juridique.

MTEB: Legal est un benchmark public créé par MTEB / MMTEB (embeddings-benchmark) pour évaluer la recherche de documents juridiques dans plusieurs langues. Il couvre notamment la jurisprudence, les statuts, les questions-réponses juridiques et le résumé juridique.

Publié en 2025, cet agrégat de tâches mesure la capacité des modèles à retrouver des contenus pertinents dans différents contextes juridiques. Il fournit ainsi un cadre commun pour comparer des modèles d’embeddings sur des usages spécialisés et multilingues, à l’aide de nDCG@10 et de métriques adaptées à chaque tâche.

Carte d'identité

CaractéristiqueValeur
Éditeur du benchmarkMTEB / MMTEB (embeddings-benchmark)
Capacités mesuréesRecherche de documents juridiques (jurisprudence, statuts, Q&R juridique, resume juridique) dans plusieurs langues.
ModalitéTexte
Type de questionsRecherche de documents juridiques, Q&R et resume
Métrique d'évaluationnDCG@10 et autres metriques selon la tache
AccèsPublic
LanguesPlusieurs langues
Taille du jeuAgregat de taches juridiques (multilingue)
Année de publication2025
RessourcesSite / dépôt officiel · Article scientifique

Classement des modèles (156)

#ModèleÉditeurLicenceScoreSortieFiabilité
1Mira190/Euler-Legal-Embedding-V1Mira190🟢 Ouvert70,4 %6 novembre 2025✅ Mesuré
2Hanno-Labs/dinghy-law-0.6b-v1Hanno-Labs🟢 Ouvert65,8 %13 juillet 2026✅ Mesuré
3voyageai/voyage-law-2Voyage AI🟢 Ouvert65,4 %15 avril 2024✅ Mesuré
4codefuse-ai/F2LLM-v2-14Bcodefuse-ai🟢 Ouvert64,7 %9 mars 2026✅ Mesuré
5voyageai/voyage-3Voyage AI🟢 Ouvert64,1 %18 septembre 2024✅ Mesuré
6infly/inf-retriever-v1infly🟢 Ouvert63,7 %24 décembre 2024✅ Mesuré
7codefuse-ai/F2LLM-v2-8Bcodefuse-ai🟢 Ouvert63,5 %9 mars 2026✅ Mesuré
8ICT-TIME-and-Querit/ICT-TIME-and-Querit-embedding-v1ICT-TIME-and-Querit🟢 Ouvert62,2 %2 mai 2026✅ Mesuré
9infly/inf-retriever-v1-1.5binfly🟢 Ouvert62,0 %8 février 2025✅ Mesuré
10codefuse-ai/F2LLM-v2-4Bcodefuse-ai🟢 Ouvert61,5 %9 mars 2026✅ Mesuré
11voyageai/voyage-3-liteVoyage AI🟢 Ouvert60,8 %18 septembre 2024✅ Mesuré
12ICT-TIME-and-Querit/BOOM_4B_v1ICT-TIME-and-Querit🟢 Ouvert60,4 %31 janvier 2026✅ Mesuré
13codefuse-ai/F2LLM-v2-1.7Bcodefuse-ai🟢 Ouvert60,3 %9 mars 2026✅ Mesuré
14openai/text-embedding-3-largeOpenAI🟢 Ouvert59,4 %25 janvier 2024✅ Mesuré
15Snowflake/snowflake-arctic-embed-l-v2.0Snowflake🟢 Ouvert59,0 %4 décembre 2024✅ Mesuré
16NovaSearch/jasper_en_vision_language_v1NovaSearch🟢 Ouvert58,8 %11 décembre 2024✅ Mesuré
17codefuse-ai/F2LLM-v2-0.6Bcodefuse-ai🟢 Ouvert57,9 %9 mars 2026✅ Mesuré
18jinaai/jina-embeddings-v3Jina AI🟢 Ouvert56,9 %18 septembre 2024✅ Mesuré
19GritLM/GritLM-7BGritLM🟢 Ouvert56,7 %15 février 2024✅ Mesuré
20codefuse-ai/F2LLM-v2-330Mcodefuse-ai🟢 Ouvert56,7 %9 mars 2026✅ Mesuré
21Snowflake/snowflake-arctic-embed-m-v2.0Snowflake🟢 Ouvert56,6 %4 décembre 2024✅ Mesuré
22openai/text-embedding-3-smallOpenAI🟢 Ouvert56,3 %25 janvier 2024✅ Mesuré
23Salesforce/SFR-Embedding-2_RSalesforce🟢 Ouvert55,8 %14 juin 2024✅ Mesuré
24Alibaba-NLP/gte-Qwen2-1.5B-instructAlibaba🟢 Ouvert55,6 %29 juillet 2024✅ Mesuré
25Linq-AI-Research/Linq-Embed-MistralLinq-AI-Research🟢 Ouvert55,4 %29 mai 2024✅ Mesuré
26infgrad/Jasper-Token-Compression-600Minfgrad🟢 Ouvert55,4 %14 novembre 2025✅ Mesuré
27Salesforce/SFR-Embedding-MistralSalesforce🟢 Ouvert55,3 %24 janvier 2024✅ Mesuré
28manu/bge-m3-custom-frmanu🟢 Ouvert55,1 %11 avril 2024✅ Mesuré
29intfloat/multilingual-e5-large-instructIntfloat🟢 Ouvert54,9 %8 février 2024✅ Mesuré
30HIT-TMG/KaLM-embedding-multilingual-mini-instruct-v1HIT-TMG🟢 Ouvert54,5 %23 octobre 2024✅ Mesuré
31Alibaba-NLP/gte-multilingual-baseAlibaba🟢 Ouvert54,5 %20 juillet 2024✅ Mesuré
32intfloat/e5-mistral-7b-instructIntfloat🟢 Ouvert54,3 %8 février 2024✅ Mesuré
33Alibaba-NLP/gte-Qwen2-7B-instructAlibaba🟢 Ouvert54,2 %15 juin 2024✅ Mesuré
34GritLM/GritLM-8x7BGritLM🟢 Ouvert54,1 %15 février 2024✅ Mesuré
35HIT-TMG/KaLM-embedding-multilingual-mini-v1HIT-TMG🟢 Ouvert53,9 %27 août 2024✅ Mesuré
36OrdalieTech/Solon-embeddings-large-0.1OrdalieTech🟢 Ouvert53,7 %9 décembre 2023✅ Mesuré
37Lajavaness/bilingual-embedding-largeLajavaness🟢 Ouvert52,3 %24 juin 2024✅ Mesuré
38Cohere/Cohere-embed-multilingual-v3.0Cohere🟢 Ouvert52,1 %2 novembre 2023✅ Mesuré
39Alibaba-NLP/gte-Qwen1.5-7B-instructAlibaba🟢 Ouvert51,6 %20 avril 2024✅ Mesuré
40NovaSearch/stella_en_1.5B_v5NovaSearch🟢 Ouvert50,3 %12 juillet 2024✅ Mesuré
41Cohere/Cohere-embed-multilingual-light-v3.0Cohere🟢 Ouvert50,2 %2 novembre 2023✅ Mesuré
42codefuse-ai/F2LLM-v2-160Mcodefuse-ai🟢 Ouvert49,9 %9 mars 2026✅ Mesuré
43Lajavaness/bilingual-embedding-smallLajavaness🟢 Ouvert49,4 %17 juillet 2024✅ Mesuré
44Lajavaness/bilingual-embedding-baseLajavaness🟢 Ouvert49,0 %26 juin 2024✅ Mesuré
45intfloat/multilingual-e5-baseIntfloat🟢 Ouvert48,5 %8 février 2024✅ Mesuré
46Intfloat: Multilingual-E5-LargeIntfloat🟢 Ouvert48,4 %18 novembre 2025✅ Mesuré
47deepvk/USER-bge-m3deepvk🟢 Ouvert47,4 %5 juillet 2024✅ Mesuré
48intfloat/multilingual-e5-smallIntfloat🟢 Ouvert47,4 %8 février 2024✅ Mesuré
49nvidia/NV-Embed-v1NVIDIA🟢 Ouvert46,5 %13 septembre 2024✅ Mesuré
50ibm-granite/granite-embedding-278m-multilingualIBM🟢 Ouvert45,8 %18 décembre 2024✅ Mesuré
51nomic-ai/nomic-embed-text-v1-unsupervisedNomic AI🟢 Ouvert45,5 %15 janvier 2024✅ Mesuré
52NovaSearch/stella_en_400M_v5NovaSearch🟢 Ouvert44,9 %12 juillet 2024✅ Mesuré
53sentence-transformers/static-similarity-mrl-multilingual-v1Sentence Transformers🟢 Ouvert44,8 %15 janvier 2025✅ Mesuré
54nvidia/NV-Embed-v2NVIDIA🟢 Ouvert44,3 %9 septembre 2024✅ Mesuré
55manu/sentence_croissant_alpha_v0.4manu🟢 Ouvert43,9 %27 avril 2024✅ Mesuré
56manu/sentence_croissant_alpha_v0.3manu🟢 Ouvert43,5 %26 avril 2024✅ Mesuré
57Cohere/Cohere-embed-english-v3.0Cohere🟢 Ouvert43,1 %2 novembre 2023✅ Mesuré
58codefuse-ai/F2LLM-v2-80Mcodefuse-ai🟢 Ouvert43,0 %9 mars 2026✅ Mesuré
59Haon-Chen/speed-embedding-7b-instructHaon-Chen🟢 Ouvert43,0 %31 octobre 2024✅ Mesuré
60manu/sentence_croissant_alpha_v0.2manu🟢 Ouvert42,3 %15 mars 2024✅ Mesuré
61dwzhu/e5-base-4kdwzhu🟢 Ouvert41,9 %28 mars 2024✅ Mesuré
62ibm-granite/granite-embedding-107m-multilingualIBM🟢 Ouvert41,8 %18 décembre 2024✅ Mesuré
63w601sxs/b1ade-embedw601sxs🟢 Ouvert41,8 %10 mars 2025✅ Mesuré
64nomic-ai/nomic-embed-text-v1Nomic AI🟢 Ouvert41,8 %31 janvier 2024✅ Mesuré
65Intfloat: E5-Large-v2Intfloat🟢 Ouvert41,7 %18 novembre 2025✅ Mesuré
66deepfile/embedder-100pdeepfile🟢 Ouvert41,6 %24 juillet 2023✅ Mesuré
67Snowflake/snowflake-arctic-embed-lSnowflake🟢 Ouvert41,5 %12 avril 2024✅ Mesuré
68avsolatorio/GIST-large-Embedding-v0avsolatorio🟢 Ouvert41,5 %14 février 2024✅ Mesuré
69intfloat/e5-largeIntfloat🟢 Ouvert41,2 %26 décembre 2022✅ Mesuré
70Thenlper: GTE-LargeAlibaba🟢 Ouvert41,2 %18 novembre 2025✅ Mesuré
71jinaai/jina-embedding-b-en-v1Jina AI🟢 Ouvert40,8 %7 juillet 2023✅ Mesuré
72avsolatorio/GIST-Embedding-v0avsolatorio🟢 Ouvert40,7 %31 janvier 2024✅ Mesuré
73Cohere/Cohere-embed-english-light-v3.0Cohere🟢 Ouvert40,4 %2 novembre 2023✅ Mesuré
74ibm-granite/granite-embedding-125m-englishIBM🟢 Ouvert40,3 %18 décembre 2024✅ Mesuré
75Mihaiii/IvysaurMihaiii🟢 Ouvert40,2 %27 avril 2024✅ Mesuré
76BAAI: bge-base-en-v1.5BAAI🟢 Ouvert40,2 %18 novembre 2025✅ Mesuré
77Thenlper: GTE-BaseAlibaba🟢 Ouvert40,0 %18 novembre 2025✅ Mesuré
78thenlper/gte-smallAlibaba🟢 Ouvert39,9 %27 juillet 2023✅ Mesuré
79mixedbread-ai/mxbai-embed-large-v1Mixedbread AI🟢 Ouvert39,9 %7 mars 2024✅ Mesuré
80Snowflake/snowflake-arctic-embed-m-v1.5Snowflake🟢 Ouvert39,8 %8 juillet 2024✅ Mesuré
81Snowflake/snowflake-arctic-embed-mSnowflake🟢 Ouvert39,8 %12 avril 2024✅ Mesuré
82BAAI: bge-large-en-v1.5BAAI🟢 Ouvert39,6 %18 novembre 2025✅ Mesuré
83Intfloat: E5-Base-v2Intfloat🟢 Ouvert39,5 %18 novembre 2025✅ Mesuré
84avsolatorio/GIST-small-Embedding-v0avsolatorio🟢 Ouvert39,4 %3 février 2024✅ Mesuré
85sdadas/mmlw-e5-largesdadas🟢 Ouvert39,3 %17 novembre 2023✅ Mesuré
86WhereIsAI/UAE-Large-V1WhereIsAI🟢 Ouvert39,3 %4 décembre 2023✅ Mesuré
87intfloat/e5-small-v2Intfloat🟢 Ouvert39,3 %8 février 2024✅ Mesuré
88avsolatorio/GIST-all-MiniLM-L6-v2avsolatorio🟢 Ouvert39,2 %3 février 2024✅ Mesuré
89omarelshehy/arabic-english-sts-matryoshkaomarelshehy🟢 Ouvert39,0 %13 octobre 2024✅ Mesuré
90avsolatorio/NoInstruct-small-Embedding-v0avsolatorio🟢 Ouvert38,9 %1 mai 2024✅ Mesuré
91infgrad/stella-base-en-v2infgrad🟢 Ouvert38,8 %19 octobre 2023✅ Mesuré
92BAAI/bge-small-en-v1.5BAAI🟢 Ouvert38,2 %12 septembre 2023✅ Mesuré
93Snowflake/snowflake-arctic-embed-sSnowflake🟢 Ouvert38,0 %12 avril 2024✅ Mesuré
94jinaai/jina-embedding-s-en-v1Jina AI🟢 Ouvert37,9 %7 juillet 2023✅ Mesuré
95minishlab/potion-multilingual-128Mminishlab🟢 Ouvert37,9 %23 mai 2025✅ Mesuré
96intfloat/e5-smallIntfloat🟢 Ouvert37,8 %8 février 2024✅ Mesuré
97sdadas/mmlw-e5-basesdadas🟢 Ouvert37,7 %17 novembre 2023✅ Mesuré
98Snowflake/snowflake-arctic-embed-m-longSnowflake🟢 Ouvert37,5 %12 avril 2024✅ Mesuré
99abhinand/MedEmbed-small-v0.1abhinand🟢 Ouvert37,5 %20 octobre 2024✅ Mesuré
100Sentence Transformers: all-mpnet-base-v2Sentence Transformers🟢 Ouvert37,4 %17 novembre 2025✅ Mesuré
101sdadas/mmlw-roberta-largesdadas🟢 Ouvert37,3 %17 novembre 2023✅ Mesuré
102intfloat/e5-baseIntfloat🟢 Ouvert37,0 %26 décembre 2022✅ Mesuré
103McGill-NLP/LLM2Vec-Mistral-7B-Instruct-v2-mntp-supervisedMcGill-NLP🟢 Ouvert36,5 %9 avril 2024✅ Mesuré
104sentence-transformers/paraphrase-multilingual-mpnet-base-v2Sentence Transformers🟢 Ouvert36,4 %1 novembre 2019✅ Mesuré
105Mihaiii/gte-micro-v4Mihaiii🟢 Ouvert36,3 %22 avril 2024✅ Mesuré
106Omartificial-Intelligence-Space/Arabic-labse-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert35,9 %16 juin 2024✅ Mesuré
107nomic-ai/nomic-embed-text-v1.5Nomic AI🟢 Ouvert35,8 %10 février 2024✅ Mesuré
108Mihaiii/BulbasaurMihaiii🟢 Ouvert35,8 %27 avril 2024✅ Mesuré
109ibm-granite/granite-embedding-30m-englishIBM🟢 Ouvert35,7 %18 décembre 2024✅ Mesuré
110Snowflake/snowflake-arctic-embed-xsSnowflake🟢 Ouvert35,7 %8 juillet 2024✅ Mesuré
111sdadas/mmlw-e5-smallsdadas🟢 Ouvert35,7 %17 novembre 2023✅ Mesuré
112Sentence Transformers: all-MiniLM-L6-v2Sentence Transformers🟢 Ouvert35,4 %17 novembre 2025✅ Mesuré
113brahmairesearch/slx-v0.1brahmairesearch🟢 Ouvert35,4 %13 août 2024✅ Mesuré
114sdadas/mmlw-roberta-basesdadas🟢 Ouvert35,3 %17 novembre 2023✅ Mesuré
115bigscience/sgpt-bloom-7b1-msmarcobigscience🟢 Ouvert35,2 %26 août 2022✅ Mesuré
116Omartificial-Intelligence-Space/Arabic-all-nli-triplet-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert35,0 %14 juin 2024✅ Mesuré
117minishlab/potion-base-8Mminishlab🟢 Ouvert34,8 %29 octobre 2024✅ Mesuré
118aari1995/German_Semantic_STS_V2aari1995🟢 Ouvert34,6 %17 novembre 2022✅ Mesuré
119sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2Sentence Transformers🟢 Ouvert34,4 %1 novembre 2019✅ Mesuré
120Sentence Transformers: all-MiniLM-L12-v2Sentence Transformers🟢 Ouvert33,9 %18 novembre 2025✅ Mesuré
121sergeyzh/LaBSE-ru-turbosergeyzh🟢 Ouvert33,4 %27 juin 2024✅ Mesuré
122Omartificial-Intelligence-Space/Arabic-MiniLM-L12-v2-all-nli-tripletOmartificial-Intelligence-Space🟢 Ouvert33,2 %25 juin 2024✅ Mesuré
123Mihaiii/WartortleMihaiii🟢 Ouvert33,0 %30 avril 2024✅ Mesuré
124minishlab/potion-base-4Mminishlab🟢 Ouvert32,9 %29 octobre 2024✅ Mesuré
125ai-forever/ru-en-RoSBERTaai-forever🟢 Ouvert32,6 %29 juillet 2024✅ Mesuré
126sentence-transformers/LaBSESentence Transformers🟢 Ouvert32,3 %1 novembre 2019✅ Mesuré
127Gameselo/STS-multilingual-mpnet-base-v2Gameselo🟢 Ouvert32,3 %7 juin 2024✅ Mesuré
128Mihaiii/VenusaurMihaiii🟢 Ouvert31,4 %29 avril 2024✅ Mesuré
129minishlab/M2V_base_outputminishlab🟢 Ouvert31,2 %21 septembre 2024✅ Mesuré
130minishlab/M2V_base_glove_subwordminishlab🟢 Ouvert31,0 %21 septembre 2024✅ Mesuré
131shibing624/text2vec-base-multilingualshibing624🟢 Ouvert30,6 %22 juin 2023✅ Mesuré
132Mihaiii/SquirtleMihaiii🟢 Ouvert30,1 %30 avril 2024✅ Mesuré
133cointegrated/LaBSE-en-rucointegrated🟢 Ouvert30,1 %10 juin 2021✅ Mesuré
134minishlab/potion-base-2Mminishlab🟢 Ouvert29,4 %29 octobre 2024✅ Mesuré
135consciousAI/cai-lunaris-text-embeddingsconsciousAI🟢 Ouvert28,9 %22 juin 2023✅ Mesuré
136minishlab/M2V_base_gloveminishlab🟢 Ouvert28,3 %21 septembre 2024✅ Mesuré
137McGill-NLP/LLM2Vec-Mistral-7B-Instruct-v2-mntp-unsup-simcseMcGill-NLP🟢 Ouvert27,0 %9 avril 2024✅ Mesuré
138Mihaiii/gte-microMihaiii🟢 Ouvert26,4 %21 avril 2024✅ Mesuré
139deepvk/USER-basedeepvk🟢 Ouvert26,2 %10 juin 2024✅ Mesuré
140Jaume/gemma-2b-embeddingsJaume🟢 Ouvert23,9 %29 juin 2024✅ Mesuré
141sergeyzh/rubert-tiny-turbosergeyzh🟢 Ouvert23,0 %21 juin 2024✅ Mesuré
142cointegrated/rubert-tiny2cointegrated🟢 Ouvert22,4 %28 octobre 2021✅ Mesuré
143Omartificial-Intelligence-Space/Arabic-mpnet-base-all-nli-tripletOmartificial-Intelligence-Space🟢 Ouvert20,1 %15 juin 2024✅ Mesuré
144cointegrated/rubert-tinycointegrated🟢 Ouvert20,0 %24 mai 2021✅ Mesuré
145silma-ai/silma-embeddding-matryoshka-v0.1silma-ai🟢 Ouvert19,9 %12 octobre 2024✅ Mesuré
146Omartificial-Intelligence-Space/Arabert-all-nli-triplet-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert16,4 %16 juin 2024✅ Mesuré
147jinaai/jina-embeddings-v2-small-enJina AI🟢 Ouvert16,0 %27 septembre 2023✅ Mesuré
148DeepPavlov/rubert-base-cased-sentenceDeepPavlov🟢 Ouvert15,1 %4 mars 2020✅ Mesuré
149DeepPavlov/distilrubert-small-cased-conversationalDeepPavlov🟢 Ouvert14,9 %28 juin 2022✅ Mesuré
150ai-forever/sbert_large_nlu_ruai-forever🟢 Ouvert11,9 %20 novembre 2020✅ Mesuré
151Omartificial-Intelligence-Space/Marbert-all-nli-triplet-MatryoshkaOmartificial-Intelligence-Space🟢 Ouvert11,8 %17 juin 2024✅ Mesuré
152DeepPavlov/rubert-base-casedDeepPavlov🟢 Ouvert11,7 %4 mars 2020✅ Mesuré
153malenia1/ternary-weight-embeddingmalenia1🟢 Ouvert11,6 %23 octobre 2024✅ Mesuré
154ai-forever/sbert_large_mt_nlu_ruai-forever🟢 Ouvert10,6 %18 mai 2021✅ Mesuré
155deepvk/deberta-v1-basedeepvk🟢 Ouvert9,3 %7 février 2023✅ Mesuré
156jinaai/jina-embeddings-v2-base-enJina AI🟢 Ouvert3,2 %27 septembre 2023✅ Mesuré

Classement établi sur 156 modèles évalués, dont 4 de grands éditeurs. Score médian de l'ensemble : 39,9 %.

Notre analyse

Un score élevé sur MTEB: Legal indique qu’un modèle classe efficacement les documents juridiques pertinents parmi les premiers résultats, sur un ensemble couvrant plusieurs types de contenus et plusieurs langues. Dans la base observée, Mira190/Euler-Legal-Embedding-V1 atteint 70 %, contre une médiane de 40 % pour 155 modèles. Cet écart révèle une forte différenciation entre les systèmes évalués et ne suggère pas de saturation générale du classement.

L’interprétation doit toutefois rester prudente. Les scores sont majoritairement auto-déclarés par les éditeurs, ce qui réduit l’homogénéité de la vérification par rapport à une évaluation entièrement mesurée dans un cadre unique. L’accès public au benchmark peut aussi favoriser une adaptation spécifique aux tâches, avec un risque de contamination entre données d’évaluation et processus de développement. Enfin, sa portée reste celle de la recherche juridique, des questions-réponses et du résumé juridique multilingues. Le classement renseigne donc sur ces capacités ciblées, plutôt que sur les performances générales d’un modèle hors de ce périmètre.


Sources des scores : mteb.