Qwen: Qwen3 Coder Plus

Qwen: Qwen3 Coder Plus est un LLM d’Alibaba Cloud / Qwen Team, sorti le 23 septembre 2025. Il se distingue surtout par une fenêtre de contexte de 1 000 000 tokens. Ses connaissances sont arrêtées au 30 juin 2025.

Qwen: Qwen3 Coder Plus est un LLM d’Alibaba Cloud / Qwen Team, sorti le 23 septembre 2025. Il se distingue surtout par une fenêtre de contexte de 1 000 000 tokens. Ses connaissances sont arrêtées au 30 juin 2025.

Le modèle adopte un positionnement très économique. Sa tarification se situe 69 % sous la moyenne des LLM similaires et environ 8,5 fois sous celle des modèles frontière. L’association d’un contexte très étendu et d’un tarif contenu constitue son principal trait distinctif.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurAlibaba Cloud / Qwen Team
Poids▫ n.d.
Date de sortie23 septembre 2025
Connaissances jusqu'à2025-06-30
Multimodalnon
Fenêtre de contexte1 000 000 tokens (≈ 1,0 M)
Modalités (entrée → sortie)text → text

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
Benchable : Hallucinations (Baseline)100,0 %1ᵉ / 146benchable✅ Mesuré
Benchable : Email Classification (Baseline)99,0 %11ᵉ / 163benchable✅ Mesuré
Benchable : Instruction Following (Baseline)71,0 %47ᵉ / 163benchable✅ Mesuré

Comment se situe-t-il ?

Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.

Benchable : Hallucinations (Baseline)

▶ Qwen3 Coder Plus100 %

Benchable : Email Classification (Baseline)

hermes-3-llama-3.1-405b100 %
▶ Qwen3 Coder Plus99 %

Tarifs

FournisseurEntrée / 1MSortie / 1MCache lecture / 1M
Alibaba Cloud Int.0,65 $3,25 $0,13 $

Prix en dollars US par million de tokens.

Sa tarification se situe 69 % en dessous de la moyenne des LLM similaires, et 8,5 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).

Coût & vitesse agentiques

IndicateurValeur
Coût moyen par benchmark — Benchable0,03 $
Latence moyenne par benchmark — Benchable2 min 17 s

Coûts et durées réels mesurés en exécutant le modèle comme agent. PinchBench = un run complet de 147 tâches (harness OpenClaw) ; Benchable = moyenne par benchmark. Sources : PinchBench, Benchable.ai.

Notre analyse

Forces. La fenêtre d’un million de tokens représente l’atout structurel de Qwen: Qwen3 Coder Plus. Son prix renforce ce positionnement, avec des tarifs d’entrée et de sortie nettement inférieurs à ceux des modèles comparables. Sur Email Classification, il partage la 11e place avec 40 autres modèles. Sur Hallucinations, il partage la première place avec 45 autres modèles. Ces deux benchmarks atteignent toutefois leur plafond et départagent donc peu les nombreux modèles ex æquo.

Limites et points d’attention. Instruction Following livre un résultat moins convaincant. Le modèle partage la 47e place sur 163 avec quatre autres modèles, ce qui le situe dans le premier tiers du classement, mais en retrait du groupe de tête. Le caractère plafonné des trois benchmarks limite aussi les conclusions sur ses performances relatives. Enfin, ses connaissances s’arrêtent au 30 juin 2025. Qwen: Qwen3 Coder Plus reste surtout pertinent lorsque les priorités portent sur une très grande fenêtre de contexte et un coût d’inférence contenu.


Sources des données : OpenRouter (openrouter.ai) · LLM-Stats (llm-stats.com) · Benchable.ai (benchable.ai).