intfloat/e5-mistral-7b-instruct
intfloat/e5-mistral-7b-instruct est un modèle d’embedding dense d’Intfloat, doté de 7 milliards de paramètres et de 32 couches. Initialisé depuis Mistral-7B-v0.1, il produit des vecteurs de 4 096 dimensions et accepte une longueur d’entrée recommandée allant jusqu’à 4 096 tokens.
intfloat/e5-mistral-7b-instruct est un modèle d’embedding dense d’Intfloat, doté de 7 milliards de paramètres et de 32 couches. Initialisé depuis Mistral-7B-v0.1, il produit des vecteurs de 4 096 dimensions et accepte une longueur d’entrée recommandée allant jusqu’à 4 096 tokens.
Ses poids ouverts et sa licence MIT autorisent l’auto-hébergement. Affiné sur des données multilingues, il conserve certaines capacités dans plusieurs langues, même si son usage est recommandé en anglais. Il sert à la recherche sémantique, au RAG, à la mesure de similarité et au clustering.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Modèle d'embedding |
| Éditeur | Intfloat |
| Poids | 🟢 Poids ouverts |
| Licence | MIT |
| Date de sortie | 8 février 2024 |
| Dimension du vecteur | 4 096 |
| Représentation | dense |
| Paramètres | 7 milliards |
| Paramètres actifs | 7 milliards |
| Longueur de séquence max | 32 768 tokens |
| Modalités (entrée → sortie) | text → embedding |
Performances (benchmarks)
| Benchmark | Score | Rang | Source | Fiabilité |
|---|---|---|---|---|
| MTEB: BEIR | 57,1 % | 25ᵉ / 192 | mteb | ✅ Mesuré |
| MTEB: Long-context Retrieval | 43,7 % | 54ᵉ / 170 | mteb | ✅ Mesuré |
| MTEB: Reasoning Retrieval | 17,5 % | 11ᵉ / 29 | mteb | ✅ Mesuré |
| MTEB: RTEB Legal | 46,6 % | 56ᵉ / 208 | mteb | ✅ Mesuré |
| MTEB: RTEB Healthcare | 61,2 % | 32ᵉ / 97 | mteb | ✅ Mesuré |
| MTEB: RTEB Finance | 51,0 % | 68ᵉ / 97 | mteb | ✅ Mesuré |
| MTEB: Medical | 62,7 % | 13ᵉ / 158 | mteb | ✅ Mesuré |
| MTEB: Legal | 54,3 % | 33ᵉ / 157 | mteb | ✅ Mesuré |
| MTEB: European | 61,3 % | 17ᵉ / 128 | mteb | ✅ Mesuré |
| MTEB: RTEB French | 54,4 % | 27ᵉ / 218 | mteb | ✅ Mesuré |
| MTEB: RTEB German | 44,4 % | 72ᵉ / 209 | mteb | ✅ Mesuré |
| MTEB: French | 67,2 % | 10ᵉ / 117 | mteb | ✅ Mesuré |
Scores issus de MTEB (Massive Text Embedding Benchmark), suite d'évaluation indépendante. Le rang situe le modèle parmi les modèles d'embedding évalués sur le même track.
Comment se situe-t-il ?
Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.
MTEB: BEIR
MTEB: Long-context Retrieval
Notre analyse
Forces. Le modèle se place dans le top 10 de MTEB en français et en russe. Il obtient aussi de bons rangs sur les tracks scandinave et européen, ce qui souligne son intérêt pour la classification, le clustering, la similarité et le reranking multilingues. Son classement sur MTEB Medical est également solide pour la recherche d’informations cliniques, biomédicales et de santé grand public. La limite recommandée de 4 096 tokens facilite l’indexation de passages ou de documents assez longs. Les poids ouverts sous licence MIT permettent un déploiement auto-hébergé avec Sentence Transformers ou Transformers.
Limites et points d'attention. Malgré ses résultats multilingues, l’usage recommandé reste limité à l’anglais. Chaque requête doit recevoir une instruction d’une phrase décrivant la tâche, alors que les documents sont encodés sans instruction. Les vecteurs de 4 096 dimensions alourdissent les index et rendent la recherche plus coûteuse. Les 7 milliards de paramètres augmentent aussi les besoins de déploiement. Le track RTEB Healthcare est plus en retrait que MTEB Medical. Sorti en février 2024, le modèle est ancien à l’échelle de l’IA et probablement dépassé par des modèles plus récents. Les usages pertinents sont la recherche sémantique anglophone, le RAG auto-hébergé et les corpus multilingues nécessitant une validation préalable.
Sources des données : MTEB — Massive Text Embedding Benchmark · LLM-Stats (llm-stats.com).