Qwen: Qwen3 Embedding 4B
Qwen: Qwen3 Embedding 4B est un modèle d’embedding dense de Qwen, publié le 28 octobre 2025 sous licence ouverte Apache 2.0. Fondé sur Qwen3, il compte 4 milliards de paramètres actifs, répartis sur 36 couches, et accepte des séquences allant jusqu’à 32K.
Qwen: Qwen3 Embedding 4B est un modèle d’embedding dense de Qwen, publié le 28 octobre 2025 sous licence ouverte Apache 2.0. Fondé sur Qwen3, il compte 4 milliards de paramètres actifs, répartis sur 36 couches, et accepte des séquences allant jusqu’à 32K.
Le modèle couvre plus de 100 langues et produit des vecteurs atteignant 2560 dimensions. Grâce au support MRL, cette taille peut être ajustée de 32 à 2560 dimensions. Il sert à indexer des contenus pour la recherche sémantique et le RAG, ainsi qu’à alimenter des systèmes de classification, de clustering et d’alignement de textes bilingues.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Modèle d'embedding |
| Éditeur | Alibaba Cloud / Qwen Team |
| Poids | 🟢 Poids ouverts |
| Licence | Apache 2.0 |
| Date de sortie | 28 octobre 2025 |
| Dimension du vecteur | 2 560 |
| Représentation | dense |
| Paramètres | 4 milliards |
| Paramètres actifs | 4 milliards |
| Longueur de séquence max | 32 768 tokens |
| Modalités (entrée → sortie) | text → embeddings |
Performances (benchmarks)
| Benchmark | Score | Rang | Source | Fiabilité |
|---|---|---|---|---|
| MTEB: BEIR | 61,6 % | 8ᵉ / 192 | mteb | ✅ Mesuré |
| MTEB: Code Information Retrieval | 79,2 % | 6ᵉ / 49 | mteb | ✅ Mesuré |
| MTEB: Code | 80,1 % | 7ᵉ / 43 | mteb | ✅ Mesuré |
| MTEB: CoREB | 56,5 % | 12ᵉ / 19 | mteb | ✅ Mesuré |
| MTEB: Chinese | 72,3 % | 13ᵉ / 58 | mteb | ✅ Mesuré |
| MTEB: Russian | 70,1 % | 6ᵉ / 104 | mteb | ✅ Mesuré |
| MTEB: Dutch | 63,7 % | 8ᵉ / 113 | mteb | ✅ Mesuré |
| MTEB: Instruction Following | 11,6 % | 2ᵉ / 196 | mteb | ✅ Mesuré |
Scores issus de MTEB (Massive Text Embedding Benchmark), suite d'évaluation indépendante. Le rang situe le modèle parmi les modèles d'embedding évalués sur le même track.
Comment se situe-t-il ?
Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.
MTEB: BEIR
MTEB: Code Information Retrieval
Tarifs
| Fournisseur | Prix / 1M tokens |
|---|---|
| DeepInfra | 0,02 $ |
Prix en dollars US par million de tokens.
Sa tarification se situe 55 % en dessous de la moyenne des modèles d'embedding similaires.
Notre analyse
Forces. Qwen: Qwen3 Embedding 4B se distingue surtout en recherche d’information. Son classement dans le top 10 de BEIR indique une bonne aptitude à la recherche zero-shot sur des tâches et domaines hétérogènes. Les résultats obtenus en russe et en néerlandais le placent également parmi les meilleurs modèles évalués sur ces langues, ce qui renforce son intérêt pour des corpus multilingues. La fenêtre de 32K facilite le traitement de documents longs, tandis que les instructions personnalisées permettent d’adapter la représentation à la tâche. La licence Apache 2.0 autorise l’auto-hébergement et l’intégration dans des applications commerciales.
Limites et points d'attention. Le track Chinese reste moins bien classé que les meilleurs résultats du modèle, malgré un score solide. À sa dimension maximale de 2560, chaque vecteur alourdit l’index, accroît les besoins de stockage et peut rendre la recherche plus coûteuse. Le support MRL atténue cet arbitrage en permettant de choisir une sortie plus compacte, avec une dimension comprise entre 32 et 2560. Ses usages pertinents comprennent la recherche sémantique multilingue, le RAG sur des documents longs, la classification, le clustering et l’alignement bilingue.
Sources des données : OpenRouter (openrouter.ai) · MTEB — Massive Text Embedding Benchmark · LLM-Stats (llm-stats.com).