Qwen Image
Qwen Image est un modèle chinois de génération d’images de 27 milliards de paramètres, publié par Qwen le 4 août 2025. Il transforme des descriptions textuelles en images de différents styles et peut rendre du texte en anglais comme en chinois.
Qwen Image est un modèle chinois de génération d’images de 27 milliards de paramètres, publié par Qwen le 4 août 2025. Il transforme des descriptions textuelles en images de différents styles et peut rendre du texte en anglais comme en chinois.
Utilisable avec DiffusionPipeline, il couvre aussi l’édition d’images, notamment le transfert de style, l’ajout ou la suppression d’objets, la retouche de détails et la modification de texte. Son positionnement en Arena reste toutefois en retrait par rapport aux modèles les mieux classés.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Modèle de génération d'images |
| Éditeur | Alibaba Cloud / Qwen Team |
| Poids | 🟢 Poids ouverts · usage commercial autorisé |
| Licence | Apache 2.0 |
| Modalités (entrée → sortie) | text → image |
Classements Arena (Elo)
Arena Text-to-Image · 225 modèles classés
| Rang | Modèle | Elo |
|---|---|---|
| 1ᵉ | GPT Image 2 | 1385 |
| 2ᵉ | GPT Image 2 | 1372 |
| 3ᵉ | Microsoft: MAI-Image-2.5 | 1321 |
| ⋯ | ⋯ | |
| 155ᵉ | Cosmos3-Super-Text2Image (agentic) | 1057 |
| 156ᵉ | Cosmos3-Super-Text2Image (agentic) | 1057 |
| 157ᵉ | Qwen Image | 1057 |
| 158ᵉ | Krea 1 | 1056 |
| 159ᵉ | Ideogram v2 | 1054 |
Arena Text-to-Image · 225 modèles classés
| Rang | Modèle | Elo |
|---|---|---|
| 1ᵉ | GPT Image 2 | 1385 |
| 2ᵉ | GPT Image 2 | 1372 |
| 3ᵉ | Microsoft: MAI-Image-2.5 | 1321 |
| ⋯ | ⋯ | |
| 155ᵉ | Cosmos3-Super-Text2Image (agentic) | 1057 |
| 156ᵉ | Cosmos3-Super-Text2Image (agentic) | 1057 |
| 157ᵉ | Qwen Image | 1057 |
| 158ᵉ | Krea 1 | 1056 |
| 159ᵉ | Ideogram v2 | 1054 |
Entraînement & empreinte
| Indicateur | Valeur |
|---|---|
| Jeu de données | Unspecified unreleased |
| Pays | China |
Notre analyse
Forces. Qwen Image réunit génération et édition dans un même modèle. Ses fonctions de rendu typographique, de manipulation d’objets, de changement de style et d’ajustement de poses humaines répondent aux besoins d’illustration, de design et de création publicitaire. Il prend également en charge plusieurs tâches visuelles, dont la détection d’objets, la segmentation sémantique, l’estimation de profondeur, les contours Canny, la synthèse de nouvelle vue et la super-résolution.
Limites et points d'attention. Les deux évaluations Arena disponibles le placent en retrait du classement text-to-image, loin des premières positions occupées par GPT Image 2 et MAI-Image-2.5. Ce positionnement traduit une préférence humaine globale plus faible que celle accordée aux références de tête. Qwen Image reste pertinent pour les équipes recherchant un flux DiffusionPipeline, la génération bilingue de texte dans l’image et des fonctions d’édition variées. Usages pertinents : maquettes graphiques, illustrations, visuels publicitaires et retouches ciblées. Pour un résultat plus abouti, on lui préférera OpenAI GPT Image 2 ou Microsoft MAI-Image-2.5.
Sources des données : Artificial Analysis (artificialanalysis.ai) · Arena.ai (arena.ai) · LLM-Stats (llm-stats.com) · Epoch AI (epoch.ai), CC-BY-4.0.