Qwen3.5-2B

Qwen3.5-2B est un modèle de langage multimodal de Qwen, publié le 2 mars 2026 sous licence Apache 2.0. Ses poids ouverts autorisent l’usage commercial, le prototypage, la spécialisation par fine-tuning et les travaux de recherche ou de développement.

Qwen3.5-2B est un modèle de langage multimodal de Qwen, publié le 2 mars 2026 sous licence Apache 2.0. Ses poids ouverts autorisent l’usage commercial, le prototypage, la spécialisation par fine-tuning et les travaux de recherche ou de développement.

Ce modèle de 2 milliards de paramètres associe un modèle de langage causal à un encodeur vision. Son architecture hybride combine Gated DeltaNet, Gated Attention et FFN, avec une fusion multimodale précoce, un contexte natif de 262 144 tokens et la prise en charge de 201 langues et dialectes.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurAlibaba Cloud / Qwen Team
Poids🟢 Poids ouverts · usage commercial autorisé
LicenceApache 2.0
Date de sortie2 mars 2026
Multimodaloui
Paramètres2 milliards

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
MMLU-Redux79,6 %40ᵉ / 48llm-statsAuto-déclaré
IFEval78,6 %55ᵉ / 65llm-statsAuto-déclaré
C-Eval73,2 %16ᵉ / 18llm-statsAuto-déclaré
Global PIQA69,3 %12ᵉ / 13llm-statsAuto-déclaré
MMLU-Pro66,5 %93ᵉ / 125llm-statsAuto-déclaré
MMMLU63,1 %47ᵉ / 49llm-statsAuto-déclaré
MAXIFE60,6 %10ᵉ / 11llm-statsAuto-déclaré
Include55,4 %28ᵉ / 31llm-statsAuto-déclaré
MMLU-ProX52,3 %27ᵉ / 32llm-statsAuto-déclaré
GPQA51,6 %156ᵉ / 219llm-statsAuto-déclaré
t2-bench48,8 %21ᵉ / 23llm-statsAuto-déclaré
NOVA-6346,4 %10ᵉ / 11llm-statsAuto-déclaré
WMT24++45,8 %19ᵉ / 23llm-statsAuto-déclaré
BFCL-V443,6 %12ᵉ / 13llm-statsAuto-déclaré
IFBench41,3 %25ᵉ / 27llm-statsAuto-déclaré
LongBench v238,7 %14ᵉ / 15llm-statsAuto-déclaré
SuperGPQA37,5 %33ᵉ / 34llm-statsAuto-déclaré
Multi-Challenge33,7 %26ᵉ / 28llm-statsAuto-déclaré
PolyMATH26,1 %22ᵉ / 23llm-statsAuto-déclaré
AA-LCR25,6 %14ᵉ / 15llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Notre analyse

Forces. Qwen3.5-2B réunit dans un format de 2 milliards de paramètres le traitement du langage et de la vision, un contexte particulièrement étendu et deux modes de fonctionnement, « thinking » et « non-thinking ». À sa sortie, son résultat sur GPQA le plaçait dans les trois quarts supérieurs des 167 LLM de sa génération, un positionnement honorable pour cette taille sur une évaluation de questions scientifiques difficiles. Les poids et fichiers de configuration post-entraînés sont distribués au format Hugging Face Transformers. Les artefacts fonctionnent aussi avec vLLM, SGLang et KTransformers, ce qui ouvre plusieurs voies de déploiement et d’expérimentation.

Limites et points d’attention. Le classement GPQA ne situe pas Qwen3.5-2B parmi le quart supérieur de sa génération. Son positionnement privilégie donc la compacité, l’ouverture et la polyvalence technique plutôt qu’une place au sommet sur ce benchmark. L’évaluation repose sur une seule source de données concordante, ce qui invite à interpréter ce rang comme un indicateur ciblé. Qwen3.5-2B vise surtout le prototypage, le fine-tuning propre à une tâche et les activités de recherche ou de développement nécessitant des poids ouverts, un usage commercial autorisé et une prise en charge multimodale et multilingue.


Sources des données : LLM-Stats (llm-stats.com).