Qwen Image

Qwen Image est un modèle chinois de génération d’images de 27 milliards de paramètres, publié par Qwen le 4 août 2025. Il transforme des descriptions textuelles en images de différents styles et peut rendre du texte en anglais comme en chinois.

Qwen Image est un modèle chinois de génération d’images de 27 milliards de paramètres, publié par Qwen le 4 août 2025. Il transforme des descriptions textuelles en images de différents styles et peut rendre du texte en anglais comme en chinois.

Utilisable avec DiffusionPipeline, il couvre aussi l’édition d’images, notamment le transfert de style, l’ajout ou la suppression d’objets, la retouche de détails et la modification de texte. Son positionnement en Arena reste toutefois en retrait par rapport aux modèles les mieux classés.

Caractéristiques

CaractéristiqueValeur
TypeModèle de génération d'images
ÉditeurAlibaba Cloud / Qwen Team
Poids🟢 Poids ouverts · usage commercial autorisé
LicenceApache 2.0
Modalités (entrée → sortie)text → image

Classements Arena (Elo)

Arena Text-to-Image · 225 modèles classés

RangModèleElo
1ᵉGPT Image 21385
2ᵉGPT Image 21372
3ᵉMicrosoft: MAI-Image-2.51321
155ᵉCosmos3-Super-Text2Image (agentic)1057
156ᵉCosmos3-Super-Text2Image (agentic)1057
157ᵉQwen Image1057
158ᵉKrea 11056
159ᵉIdeogram v21054

Arena Text-to-Image · 225 modèles classés

RangModèleElo
1ᵉGPT Image 21385
2ᵉGPT Image 21372
3ᵉMicrosoft: MAI-Image-2.51321
155ᵉCosmos3-Super-Text2Image (agentic)1057
156ᵉCosmos3-Super-Text2Image (agentic)1057
157ᵉQwen Image1057
158ᵉKrea 11056
159ᵉIdeogram v21054

Entraînement & empreinte

IndicateurValeur
Jeu de donnéesUnspecified unreleased
PaysChina

Notre analyse

Forces. Qwen Image réunit génération et édition dans un même modèle. Ses fonctions de rendu typographique, de manipulation d’objets, de changement de style et d’ajustement de poses humaines répondent aux besoins d’illustration, de design et de création publicitaire. Il prend également en charge plusieurs tâches visuelles, dont la détection d’objets, la segmentation sémantique, l’estimation de profondeur, les contours Canny, la synthèse de nouvelle vue et la super-résolution.

Limites et points d'attention. Les deux évaluations Arena disponibles le placent en retrait du classement text-to-image, loin des premières positions occupées par GPT Image 2 et MAI-Image-2.5. Ce positionnement traduit une préférence humaine globale plus faible que celle accordée aux références de tête. Qwen Image reste pertinent pour les équipes recherchant un flux DiffusionPipeline, la génération bilingue de texte dans l’image et des fonctions d’édition variées. Usages pertinents : maquettes graphiques, illustrations, visuels publicitaires et retouches ciblées. Pour un résultat plus abouti, on lui préférera OpenAI GPT Image 2 ou Microsoft MAI-Image-2.5.


Sources des données : Artificial Analysis (artificialanalysis.ai) · Arena.ai (arena.ai) · LLM-Stats (llm-stats.com) · Epoch AI (epoch.ai), CC-BY-4.0.