Qwen3.5-9B

Publié par Qwen le 2 mars 2026, Qwen3.5-9B est un modèle de langage causal de 9 milliards de paramètres, complété par un encodeur vision. Il prend en charge 201 langues et dialectes, ainsi que des usages de raisonnement, de codage, d’agents et de compréhension visuelle.

Publié par Qwen le 2 mars 2026, Qwen3.5-9B est un modèle de langage causal de 9 milliards de paramètres, complété par un encodeur vision. Il prend en charge 201 langues et dialectes, ainsi que des usages de raisonnement, de codage, d’agents et de compréhension visuelle.

Son contexte natif atteint 262 144 tokens et peut être étendu jusqu’à 1 010 000 tokens. Distribué sous licence Apache 2.0 avec usage commercial autorisé, il fournit ses poids au format Hugging Face Transformers et fonctionne avec Transformers, vLLM, SGLang et KTransformers. Son tarif très économique constitue un autre trait distinctif.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurAlibaba Cloud / Qwen Team
Poids🟢 Poids ouverts · usage commercial autorisé
LicenceApache 2.0
Date de sortie2 mars 2026
Multimodaloui
Paramètres9 milliards
Fenêtre de contexte262 144 tokens
Modalités (entrée → sortie)text,image,video → text

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
IFEval91,5 %12ᵉ / 65llm-statsAuto-déclaré
MMLU-Redux91,1 %22ᵉ / 48llm-statsAuto-déclaré
C-Eval88,2 %11ᵉ / 18llm-statsAuto-déclaré
MAXIFE83,4 %8ᵉ / 11llm-statsAuto-déclaré
Global PIQA83,2 %10ᵉ / 13llm-statsAuto-déclaré
HMMT 202583,2 %24ᵉ / 33llm-statsAuto-déclaré
HMMT2582,9 %12ᵉ / 25llm-statsAuto-déclaré
MMLU-Pro82,5 %35ᵉ / 125llm-statsAuto-déclaré
GPQA81,7 %68ᵉ / 219llm-statsAuto-déclaré
MMMLU81,2 %39ᵉ / 49llm-statsAuto-déclaré
t2-bench79,1 %14ᵉ / 23llm-statsAuto-déclaré
MMLU-ProX76,3 %17ᵉ / 32llm-statsAuto-déclaré
Include75,6 %16ᵉ / 31llm-statsAuto-déclaré
WMT24++72,6 %12ᵉ / 23llm-statsAuto-déclaré
BFCL-V466,1 %7ᵉ / 13llm-statsAuto-déclaré
LiveCodeBench v665,6 %35ᵉ / 53llm-statsAuto-déclaré
IFBench64,5 %22ᵉ / 27llm-statsAuto-déclaré
AA-LCR63,0 %9ᵉ / 15llm-statsAuto-déclaré
SuperGPQA58,2 %20ᵉ / 34llm-statsAuto-déclaré
PolyMATH57,3 %9ᵉ / 23llm-statsAuto-déclaré
NOVA-6355,9 %8ᵉ / 11llm-statsAuto-déclaré
LongBench v255,2 %11ᵉ / 15llm-statsAuto-déclaré
Multi-Challenge54,5 %13ᵉ / 28llm-statsAuto-déclaré
VITA-Bench29,8 %9ᵉ / 10llm-statsAuto-déclaré
DeepPlanning18,0 %8ᵉ / 9llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Tarifs

FournisseurEntrée / 1MSortie / 1MCache lecture / 1M
SiliconFlow0,1 $0,15 $n.d.

Prix en dollars US par million de tokens.

Sa tarification se situe 95 % en dessous de la moyenne des LLM similaires, et 55 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).

Coût & vitesse agentiques

IndicateurValeur
Coût moyen par benchmark — Benchable0,03 $
Latence moyenne par benchmark — Benchable1 h 04 min

Coûts et durées réels mesurés en exécutant le modèle comme agent. PinchBench = un run complet de 147 tâches (harness OpenClaw) ; Benchable = moyenne par benchmark. Sources : PinchBench, Benchable.ai.

Notre analyse

Forces. Qwen3.5-9B se classe dans le top 10 en Ethics et en Mathematics, ses deux résultats les plus solides. Ses scores en General Knowledge et en Email Classification sont également élevés, même si leurs rangs relatifs sont moins favorables. À sa sortie, son résultat sur GPQA le plaçait dans le top 26% des 167 LLM de sa génération. Son architecture associe Gated Delta Networks, gated attention et FFN, selon une disposition alternant plusieurs blocs DeltaNet avec un bloc d’attention. La longue fenêtre de contexte et l’encodeur vision élargissent son champ d’utilisation au-delà du texte court.

Limites et points d’attention. Reasoning constitue sa faiblesse la plus visible, avec un résultat inférieur à ceux obtenus dans les autres catégories et un classement en seconde moitié de tableau. Coding atteint un niveau plus solide, mais reste loin du groupe de tête. Les excellents pourcentages en General Knowledge et Email Classification doivent aussi être relativisés par des rangs modestes face aux modèles évalués. En contrepartie, Qwen3.5-9B coûte 95% de moins que la moyenne des LLM similaires et environ 55 fois moins cher que les modèles frontière. Il cible ainsi les usages multilingues, multimodaux et à long contexte qui privilégient des coûts d’inférence réduits.


Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai) · Benchable.ai (benchable.ai).