Qwen: Qwen3 Coder Flash

Qwen: Qwen3 Coder Flash est un LLM d’Alibaba Cloud et de la Qwen Team, sorti le 17 septembre 2025. Orienté vers le code, il se distingue surtout par une fenêtre de contexte de 1 000 000 tokens. Ses connaissances couvrent les informations disponibles jusqu’au 30 juin 2025.

Qwen: Qwen3 Coder Flash est un LLM d’Alibaba Cloud et de la Qwen Team, sorti le 17 septembre 2025. Orienté vers le code, il se distingue surtout par une fenêtre de contexte de 1 000 000 tokens. Ses connaissances couvrent les informations disponibles jusqu’au 30 juin 2025.

Son autre caractéristique majeure est son positionnement très économique. Sa tarification se situe 91% sous la moyenne des LLM similaires et environ 28,2 fois sous celle des modèles frontière. Cette combinaison entre contexte étendu et coût réduit constitue son principal intérêt.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurAlibaba Cloud / Qwen Team
Poids▫ n.d.
Date de sortie17 septembre 2025
Connaissances jusqu'à2025-06-30
Multimodalnon
Fenêtre de contexte1 000 000 tokens (≈ 1,0 M)
Modalités (entrée → sortie)text → text

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
Benchable : Ethics (Baseline)98,0 %105ᵉ / 159benchable✅ Mesuré
Benchable : Coding (Baseline)92,0 %56ᵉ / 162benchable✅ Mesuré
Benchable : Email Classification (Baseline)91,0 %143ᵉ / 163benchable✅ Mesuré
Benchable : Mathematics (Baseline)84,0 %96ᵉ / 140benchable✅ Mesuré
Benchable : General Knowledge (Baseline)81,5 %140ᵉ / 161benchable✅ Mesuré
Benchable : Hallucinations (Baseline)78,0 %110ᵉ / 146benchable✅ Mesuré
Benchable : Reasoning (Baseline)76,0 %81ᵉ / 155benchable✅ Mesuré
Benchable : Instruction Following (Baseline)56,0 %96ᵉ / 163benchable✅ Mesuré

Comment se situe-t-il ?

Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.

Benchable : Ethics (Baseline)

▶ Qwen3 Coder Flash98 %

Benchable : Coding (Baseline)

cydonia-24b-v4.1100 %
▶ Qwen3 Coder Flash92 %

Tarifs

FournisseurEntrée / 1MSortie / 1MCache lecture / 1M
Alibaba Cloud Int.0,195 $0,975 $0,039 $

Prix en dollars US par million de tokens.

Sa tarification se situe 91 % en dessous de la moyenne des LLM similaires, et 28,2 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).

Coût & vitesse agentiques

IndicateurValeur
Coût moyen par benchmark — Benchable0,02 $
Latence moyenne par benchmark — Benchable3 min 29 s

Coûts et durées réels mesurés en exécutant le modèle comme agent. PinchBench = un run complet de 147 tâches (harness OpenClaw) ; Benchable = moyenne par benchmark. Sources : PinchBench, Benchable.ai.

Notre analyse

Forces. Qwen: Qwen3 Coder Flash obtient un taux brut élevé en Coding (Baseline), où il partage toutefois la 56e place avec huit autres modèles. Son résultat en Ethics (Baseline) atteint également un niveau élevé, mais il partage la 105e place avec 19 modèles. Ces deux benchmarks plafonnés départagent donc mal les concurrents. La fenêtre de 1 000 000 tokens constitue un avantage concret pour traiter de très longues entrées. Le tarif renforce ce positionnement : l’entrée coûte 0,195 $ par million de tokens et la sortie 0,975 $.

Limites et points d’attention. Les classements Benchable placent le modèle en retrait dans plusieurs domaines. Il occupe le rang 140 sur 161 en General Knowledge et partage la 143e place en Email Classification. Mathematics le situe à la 96e place sur 140, tandis que Hallucinations le place au 110e rang sur 146. Coding reste mieux positionné, mais son benchmark plafonné ne suffit pas à établir un avantage net. Le modèle convient surtout aux tâches de code à faible coût et aux traitements nécessitant un contexte très étendu.


Sources des données : OpenRouter (openrouter.ai) · LLM-Stats (llm-stats.com) · Benchable.ai (benchable.ai).