Qwen: Qwen-Audio-3.0-TTS Flash
Qwen: Qwen-Audio-3.0-TTS Flash est un modèle de synthèse vocale édité par Qwen et sorti le 23 juillet 2026. Il transforme du texte en parole pour produire des contenus audio à partir de scripts ou de réponses écrites.
Qwen: Qwen-Audio-3.0-TTS Flash est un modèle de synthèse vocale édité par Qwen et sorti le 23 juillet 2026. Il transforme du texte en parole pour produire des contenus audio à partir de scripts ou de réponses écrites.
Le modèle adopte un positionnement économique. Sa tarification se situe 100 % sous la moyenne des modèles similaires. La composante d’entrée est payante, tandis que la sortie est gratuite.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Synthèse vocale (text-to-speech) |
| Éditeur | Qwen |
| Poids | ▫ n.d. |
| Date de sortie | 23 juillet 2026 |
| Modalités (entrée → sortie) | text → speech |
Tarifs
| Fournisseur | Entrée / 1M | Sortie / 1M | Cache lecture / 1M |
|---|---|---|---|
| Alibaba Cloud Int. | 15 $ | gratuit | n.d. |
Prix en dollars US par million de tokens.
Sa tarification se situe 100 % en dessous de la moyenne des modèles similaires.
Notre analyse
Forces. Son principal atout est son coût inférieur à la moyenne de sa catégorie. La gratuité de la sortie facilite les usages qui génèrent régulièrement de la parole, notamment les voix off, les assistants vocaux, le doublage et la lecture de textes à des fins d’accessibilité.
Limites et points d’attention. La composante d’entrée reste facturée, le coût augmente donc avec le volume traité. Le positionnement tarifaire renseigne sur l’économie d’usage, pas sur la qualité perceptive de la parole produite. Usages pertinents : voix off, assistants vocaux, doublage et accessibilité.
Sources des données : OpenRouter (openrouter.ai).