Qwen: Qwen3 Coder Plus
Qwen: Qwen3 Coder Plus est un LLM d’Alibaba Cloud / Qwen Team, sorti le 23 septembre 2025. Il se distingue surtout par une fenêtre de contexte de 1 000 000 tokens. Ses connaissances sont arrêtées au 30 juin 2025.
Qwen: Qwen3 Coder Plus est un LLM d’Alibaba Cloud / Qwen Team, sorti le 23 septembre 2025. Il se distingue surtout par une fenêtre de contexte de 1 000 000 tokens. Ses connaissances sont arrêtées au 30 juin 2025.
Le modèle adopte un positionnement très économique. Sa tarification se situe 69 % sous la moyenne des LLM similaires et environ 8,5 fois sous celle des modèles frontière. L’association d’un contexte très étendu et d’un tarif contenu constitue son principal trait distinctif.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | Alibaba Cloud / Qwen Team |
| Poids | ▫ n.d. |
| Date de sortie | 23 septembre 2025 |
| Connaissances jusqu'à | 2025-06-30 |
| Multimodal | non |
| Fenêtre de contexte | 1 000 000 tokens (≈ 1,0 M) |
| Modalités (entrée → sortie) | text → text |
Performances (benchmarks)
| Benchmark | Score | Rang (LLM) | Source | Fiabilité |
|---|---|---|---|---|
| Benchable : Hallucinations (Baseline) | 100,0 % | 1ᵉ / 146 | benchable | ✅ Mesuré |
| Benchable : Email Classification (Baseline) | 99,0 % | 11ᵉ / 163 | benchable | ✅ Mesuré |
| Benchable : Instruction Following (Baseline) | 71,0 % | 47ᵉ / 163 | benchable | ✅ Mesuré |
Comment se situe-t-il ?
Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.
Benchable : Hallucinations (Baseline)
Benchable : Email Classification (Baseline)
Tarifs
| Fournisseur | Entrée / 1M | Sortie / 1M | Cache lecture / 1M |
|---|---|---|---|
| Alibaba Cloud Int. | 0,65 $ | 3,25 $ | 0,13 $ |
Prix en dollars US par million de tokens.
Sa tarification se situe 69 % en dessous de la moyenne des LLM similaires, et 8,5 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).
Coût & vitesse agentiques
| Indicateur | Valeur |
|---|---|
| Coût moyen par benchmark — Benchable | 0,03 $ |
| Latence moyenne par benchmark — Benchable | 2 min 17 s |
Coûts et durées réels mesurés en exécutant le modèle comme agent. PinchBench = un run complet de 147 tâches (harness OpenClaw) ; Benchable = moyenne par benchmark. Sources : PinchBench, Benchable.ai.
Notre analyse
Forces. La fenêtre d’un million de tokens représente l’atout structurel de Qwen: Qwen3 Coder Plus. Son prix renforce ce positionnement, avec des tarifs d’entrée et de sortie nettement inférieurs à ceux des modèles comparables. Sur Email Classification, il partage la 11e place avec 40 autres modèles. Sur Hallucinations, il partage la première place avec 45 autres modèles. Ces deux benchmarks atteignent toutefois leur plafond et départagent donc peu les nombreux modèles ex æquo.
Limites et points d’attention. Instruction Following livre un résultat moins convaincant. Le modèle partage la 47e place sur 163 avec quatre autres modèles, ce qui le situe dans le premier tiers du classement, mais en retrait du groupe de tête. Le caractère plafonné des trois benchmarks limite aussi les conclusions sur ses performances relatives. Enfin, ses connaissances s’arrêtent au 30 juin 2025. Qwen: Qwen3 Coder Plus reste surtout pertinent lorsque les priorités portent sur une très grande fenêtre de contexte et un coût d’inférence contenu.
Sources des données : OpenRouter (openrouter.ai) · LLM-Stats (llm-stats.com) · Benchable.ai (benchable.ai).