RTEB Finance

MTEB: RTEB Finance est un benchmark créé par Hugging Face et le projet MTEB (embeddings-benchmark). Ce sous-ensemble spécialisé de RTEB évalue la qualité de récupération de documents dans le domaine financier, notamment pour les questions-réponses, les documents financiers et la…

MTEB: RTEB Finance est un benchmark créé par Hugging Face et le projet MTEB (embeddings-benchmark). Ce sous-ensemble spécialisé de RTEB évalue la qualité de récupération de documents dans le domaine financier, notamment pour les questions-réponses, les documents financiers et la gouvernance d’entreprise.

Il mesure la capacité des modèles d’embeddings à retrouver des contenus pertinents face à des demandes représentatives d’usages réels en production. Il sert ainsi à comparer les performances de retrieval spécialisé, au-delà d’une évaluation généraliste des représentations textuelles.

Carte d'identité

CaractéristiqueValeur
Éditeur du benchmarkHugging Face / MTEB (embeddings-benchmark)
Capacités mesuréesQualite de recuperation (retrieval) de documents dans le domaine financier (Q&A, documents financiers, gouvernance d'entreprise)
ModalitéTexte
Type de questionsRecuperation d'information (retrieval) dans le domaine financier
Métrique d'évaluationNDCG@10
AccèsJeu de test privé (réponses non divulguées)
LanguesRTEB couvre ~20 langues ; sous-ensemble finance majoritairement anglais
Année de publication2025
RessourcesSite / dépôt officiel · Article scientifique

Classement des modèles (95)

#ModèleÉditeurLicenceScoreSortieFiabilité
1nvidia/Nemotron-3-Embed-8B-BF16NVIDIA🟢 Ouvert87,9 %16 juillet 2026✅ Mesuré
2voyageai/voyage-4-large (embed_dim=2048, evolved_prompts=True)Voyage AI🟢 Ouvert87,3 %15 janvier 2026✅ Mesuré
3voyageai/voyage-4-large (embed_dim=2048)Voyage AI🟢 Ouvert86,5 %15 janvier 2026✅ Mesuré
4voyageai/voyage-4-largeVoyage AI🟢 Ouvert86,1 %15 janvier 2026✅ Mesuré
5voyageai/voyage-3-largeVoyage AI🟢 Ouvert84,7 %7 janvier 2025✅ Mesuré
6voyageai/voyage-4Voyage AI🟢 Ouvert83,7 %15 janvier 2026✅ Mesuré
7Octen/Octen-Embedding-8BOcten🟢 Ouvert83,2 %23 décembre 2025✅ Mesuré
8voyageai/voyage-3.5Voyage AI🟢 Ouvert82,7 %21 janvier 2025✅ Mesuré
9voyageai/voyage-3.5 (output_dtype=int8)Voyage AI🟢 Ouvert82,7 %21 janvier 2025✅ Mesuré
10Octen/Octen-Embedding-8B-INT8Octen🟢 Ouvert82,3 %10 janvier 2026✅ Mesuré
11voyageai/voyage-4-liteVoyage AI🟢 Ouvert81,1 %15 janvier 2026✅ Mesuré
12Octen/octen-vl-embedding-largeOcten🟢 Ouvert81,0 %15 mai 2026✅ Mesuré
13Octen/Octen-Embedding-4BOcten🟢 Ouvert80,0 %30 décembre 2025✅ Mesuré
14Octen/Octen-Embedding-4B-INT8Octen🟢 Ouvert79,5 %2 avril 2026✅ Mesuré
15google/gemini-embedding-2-previewGoogle🟢 Ouvert78,6 %25 mars 2025✅ Mesuré
16bflhc/MoD-Embeddingbflhc🟢 Ouvert78,0 %14 décembre 2025✅ Mesuré
17google/gemini-embedding-001Google🟢 Ouvert77,9 %7 mars 2025✅ Mesuré
18voyageai/voyage-3.5 (output_dtype=binary)Voyage AI🟢 Ouvert77,8 %21 janvier 2025✅ Mesuré
19nvidia/Nemotron-3-Embed-1B-BF16NVIDIA🟢 Ouvert77,4 %16 juillet 2026✅ Mesuré
20codefuse-ai/F2LLM-v2-14Bcodefuse-ai🟢 Ouvert76,0 %9 mars 2026✅ Mesuré
21Cohere/Cohere-embed-v4.0 (output_dtype=int8)Cohere🟢 Ouvert75,2 %1 décembre 2024✅ Mesuré
22Cohere/Cohere-embed-v4.0Cohere🟢 Ouvert75,0 %1 décembre 2024✅ Mesuré
23codefuse-ai/F2LLM-v2-8Bcodefuse-ai🟢 Ouvert74,8 %9 mars 2026✅ Mesuré
24codefuse-ai/F2LLM-v2-4Bcodefuse-ai🟢 Ouvert73,9 %9 mars 2026✅ Mesuré
25Octen/Octen-Embedding-0.6BOcten🟢 Ouvert73,5 %10 janvier 2026✅ Mesuré
26google/text-embedding-004Google🟢 Ouvert72,9 %14 mai 2024✅ Mesuré
27Qwen: Qwen3 Embedding 8BAlibaba Cloud / Qwen Team🟢 Ouvert72,7 %28 octobre 2025✅ Mesuré
28Octen/octen-vl-embeddingOcten🟢 Ouvert72,2 %15 mai 2026✅ Mesuré
29Cohere/Cohere-embed-v4.0 (output_dtype=binary)Cohere🟢 Ouvert71,9 %1 décembre 2024✅ Mesuré
30google/text-embedding-005Google🟢 Ouvert71,9 %18 novembre 2024✅ Mesuré
31nvidia/NV-Embed-v2NVIDIA🟢 Ouvert71,5 %9 septembre 2024✅ Mesuré
32GritLM/GritLM-7BGritLM🟢 Ouvert71,3 %15 février 2024✅ Mesuré
33jinaai/jina-embeddings-v4Jina AI🟢 Ouvert70,6 %24 juin 2025✅ Mesuré
34codefuse-ai/F2LLM-v2-1.7Bcodefuse-ai🟢 Ouvert68,9 %9 mars 2026✅ Mesuré
35ICT-TIME-and-Querit/ICT-TIME-and-Querit-embedding-v1ICT-TIME-and-Querit🟢 Ouvert68,6 %2 mai 2026✅ Mesuré
36openai/text-embedding-3-largeOpenAI🟢 Ouvert67,8 %25 janvier 2024✅ Mesuré
37ICT-TIME-and-Querit/BOOM_4B_v1ICT-TIME-and-Querit🟢 Ouvert67,4 %31 janvier 2026✅ Mesuré
38jinaai/jina-embeddings-v5-omni-smallJina AI🟢 Ouvert66,1 %1 avril 2026✅ Mesuré
39jinaai/jina-embeddings-v5-text-smallJina AI🟢 Ouvert66,1 %17 février 2026✅ Mesuré
40jinaai/jina-embeddings-v5-omni-nanoJina AI🟢 Ouvert64,8 %1 avril 2026✅ Mesuré
41jinaai/jina-embeddings-v5-text-nanoJina AI🟢 Ouvert64,8 %17 février 2026✅ Mesuré
42telepix/PIXIE-Rune-v1.0telepix🟢 Ouvert63,9 %15 janvier 2026✅ Mesuré
43codefuse-ai/F2LLM-v2-0.6Bcodefuse-ai🟢 Ouvert63,1 %9 mars 2026✅ Mesuré
44Snowflake/snowflake-arctic-embed-l-v2.0Snowflake🟢 Ouvert62,2 %4 décembre 2024✅ Mesuré
45openai/text-embedding-3-smallOpenAI🟢 Ouvert60,8 %25 janvier 2024✅ Mesuré
46codefuse-ai/F2LLM-v2-330Mcodefuse-ai🟢 Ouvert60,7 %9 mars 2026✅ Mesuré
47Alibaba-NLP/gte-base-en-v1.5Alibaba🟢 Ouvert58,7 %20 juin 2024✅ Mesuré
48intfloat/multilingual-e5-large-instructIntfloat🟢 Ouvert58,6 %8 février 2024✅ Mesuré
49BAAI: bge-large-en-v1.5BAAI🟢 Ouvert58,2 %18 novembre 2025✅ Mesuré
50ibm-granite/granite-embedding-english-r2IBM🟢 Ouvert58,2 %15 août 2025✅ Mesuré
51BAAI: bge-m3BAAI🟢 Ouvert57,7 %18 novembre 2025✅ Mesuré
52WhereIsAI/UAE-Large-V1WhereIsAI🟢 Ouvert57,5 %4 décembre 2023✅ Mesuré
53mixedbread-ai/mxbai-embed-large-v1Mixedbread AI🟢 Ouvert57,4 %7 mars 2024✅ Mesuré
54BAAI/bge-large-enBAAI🟢 Ouvert57,1 %5 août 2023✅ Mesuré
55BAAI/bge-m3-unsupervisedBAAI🟢 Ouvert56,3 %30 janvier 2024✅ Mesuré
56MongoDB/mdbr-leaf-irMongoDB🟢 Ouvert56,0 %27 août 2025✅ Mesuré
57Sentence Transformers: all-mpnet-base-v2Sentence Transformers🟢 Ouvert55,9 %17 novembre 2025✅ Mesuré
58Alibaba-NLP/gte-multilingual-baseAlibaba🟢 Ouvert55,3 %20 juillet 2024✅ Mesuré
59BAAI: bge-base-en-v1.5BAAI🟢 Ouvert54,7 %18 novembre 2025✅ Mesuré
60bisectgroup/BiCA-basebisectgroup🟢 Ouvert54,3 %14 novembre 2025✅ Mesuré
61Cohere/Cohere-embed-multilingual-v3.0Cohere🟢 Ouvert54,2 %2 novembre 2023✅ Mesuré
62BAAI/bge-base-enBAAI🟢 Ouvert53,6 %5 août 2023✅ Mesuré
63MongoDB/mdbr-leaf-mtMongoDB🟢 Ouvert53,6 %27 août 2025✅ Mesuré
64ibm-granite/granite-embedding-311m-multilingual-r2IBM🟢 Ouvert52,9 %29 avril 2026✅ Mesuré
65codefuse-ai/F2LLM-v2-160Mcodefuse-ai🟢 Ouvert52,9 %9 mars 2026✅ Mesuré
66jinaai/jina-embeddings-v2-base-enJina AI🟢 Ouvert52,4 %27 septembre 2023✅ Mesuré
67Cohere/Cohere-embed-english-v3.0Cohere🟢 Ouvert51,4 %2 novembre 2023✅ Mesuré
68intfloat/e5-mistral-7b-instructIntfloat🟢 Ouvert51,0 %8 février 2024✅ Mesuré
69intfloat/multilingual-e5-smallIntfloat🟢 Ouvert51,0 %8 février 2024✅ Mesuré
70BAAI/bge-small-en-v1.5BAAI🟢 Ouvert50,9 %12 septembre 2023✅ Mesuré
71ibm-granite/granite-embedding-small-english-r2IBM🟢 Ouvert50,5 %15 août 2025✅ Mesuré
72ibm-granite/granite-embedding-97m-multilingual-r2IBM🟢 Ouvert48,1 %29 avril 2026✅ Mesuré
73codefuse-ai/F2LLM-v2-80Mcodefuse-ai🟢 Ouvert47,6 %9 mars 2026✅ Mesuré
74sentence-transformers/multi-qa-MiniLM-L6-cos-v1Sentence Transformers🟢 Ouvert46,2 %30 août 2021✅ Mesuré
75jinaai/jina-embeddings-v2-small-enJina AI🟢 Ouvert45,8 %27 septembre 2023✅ Mesuré
76Sentence Transformers: all-MiniLM-L6-v2Sentence Transformers🟢 Ouvert43,8 %17 novembre 2025✅ Mesuré
77Sentence Transformers: all-MiniLM-L12-v2Sentence Transformers🟢 Ouvert43,3 %18 novembre 2025✅ Mesuré
78sentence-transformers/static-retrieval-mrl-en-v1Sentence Transformers🟢 Ouvert37,4 %24 octobre 2024✅ Mesuré
79BAAI/bge-large-zh-v1.5BAAI🟢 Ouvert36,5 %12 septembre 2023✅ Mesuré
80sentence-transformers/paraphrase-multilingual-mpnet-base-v2Sentence Transformers🟢 Ouvert36,2 %1 novembre 2019✅ Mesuré
81BAAI/bge-base-zh-v1.5BAAI🟢 Ouvert34,9 %11 septembre 2023✅ Mesuré
82sentence-transformers/static-similarity-mrl-multilingual-v1Sentence Transformers🟢 Ouvert29,8 %15 janvier 2025✅ Mesuré
83sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2Sentence Transformers🟢 Ouvert29,8 %1 novembre 2019✅ Mesuré
84minishlab/potion-base-8Mminishlab🟢 Ouvert29,1 %29 octobre 2024✅ Mesuré
85minishlab/potion-multilingual-128Mminishlab🟢 Ouvert27,3 %23 mai 2025✅ Mesuré
86sentence-transformers/LaBSESentence Transformers🟢 Ouvert27,0 %1 novembre 2019✅ Mesuré
87minishlab/potion-base-4Mminishlab🟢 Ouvert26,4 %29 octobre 2024✅ Mesuré
88minishlab/M2V_base_gloveminishlab🟢 Ouvert25,5 %21 septembre 2024✅ Mesuré
89BAAI/bge-small-zh-v1.5BAAI🟢 Ouvert24,6 %12 septembre 2023✅ Mesuré
90minishlab/potion-base-2Mminishlab🟢 Ouvert23,1 %29 octobre 2024✅ Mesuré
91minishlab/M2V_base_glove_subwordminishlab🟢 Ouvert20,8 %21 septembre 2024✅ Mesuré
92minishlab/M2V_base_outputminishlab🟢 Ouvert20,7 %21 septembre 2024✅ Mesuré
93shibing624/text2vec-base-multilingualshibing624🟢 Ouvert16,8 %22 juin 2023✅ Mesuré
94shibing624/text2vec-base-chineseshibing624🟢 Ouvert15,2 %23 janvier 2022✅ Mesuré
95minishlab/M2V_multilingual_outputminishlab🟢 Ouvert14,0 %21 septembre 2024✅ Mesuré

Classement établi sur 95 modèles évalués, dont 9 de grands éditeurs. Score médian de l'ensemble : 58,6 %.

Notre analyse

Un score NDCG@10 élevé indique que le modèle place plus efficacement les documents pertinents parmi les dix premiers résultats. Le classement fait apparaître un écart marqué entre la médiane de 58 % sur 93 modèles et les 87 % de voyageai/voyage-4-large (embed_dim=2048, evolved_prompts=True), ce qui distingue nettement le meilleur résultat sans suggérer une saturation générale du benchmark.

La rigueur doit toutefois être nuancée, car les scores sont majoritairement auto-déclarés par les éditeurs. Le jeu de test privé, dont les réponses ne sont pas divulguées, réduit l’exposition directe des résultats attendus sur les tâches concernées. L’ensemble combine néanmoins des jeux ouverts et fermés, ce qui implique des niveaux d’exposition différents et ne permet pas d’écarter uniformément le risque de contamination. Enfin, la portée reste spécialisée dans la finance et le sous-ensemble est majoritairement anglophone, même si RTEB couvre environ vingt langues. Le classement renseigne donc avant tout sur l’efficacité du retrieval financier dans ce cadre précis, plutôt que sur les capacités générales des modèles d’embeddings.


Sources des scores : mteb.