Qwen3.5-0.8B

Publié par Qwen le 2 mars 2026, Qwen3.5-0.8B est un modèle de langage causal compact de 800 millions de paramètres, associé à un encodeur vision. Son architecture hybride combine Gated DeltaNet, Gated Attention et FFN, avec un contexte natif de 262 144 tokens.

Publié par Qwen le 2 mars 2026, Qwen3.5-0.8B est un modèle de langage causal compact de 800 millions de paramètres, associé à un encodeur vision. Son architecture hybride combine Gated DeltaNet, Gated Attention et FFN, avec un contexte natif de 262 144 tokens.

Le modèle couvre 201 langues et dialectes, traite des contenus textuels et visuels et propose des modes Thinking et Non-Thinking. Ses poids et fichiers de configuration sont distribués au format Hugging Face Transformers sous licence Apache 2.0, qui autorise l’usage commercial.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurAlibaba Cloud / Qwen Team
Poids🟢 Poids ouverts · usage commercial autorisé
LicenceApache 2.0
Date de sortie2 mars 2026
Multimodaloui
Paramètres800 millions

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
MMLU-Redux59,5 %47ᵉ / 48llm-statsAuto-déclaré
Global PIQA59,4 %13ᵉ / 13llm-statsAuto-déclaré
C-Eval50,5 %17ᵉ / 18llm-statsAuto-déclaré
MMMLU44,3 %49ᵉ / 49llm-statsAuto-déclaré
IFEval44,0 %65ᵉ / 65llm-statsAuto-déclaré
NOVA-6342,4 %11ᵉ / 11llm-statsAuto-déclaré
MMLU-Pro42,3 %120ᵉ / 125llm-statsAuto-déclaré
Include40,6 %29ᵉ / 31llm-statsAuto-déclaré
MAXIFE39,2 %11ᵉ / 11llm-statsAuto-déclaré
MMLU-ProX34,6 %28ᵉ / 32llm-statsAuto-déclaré
WMT24++27,2 %23ᵉ / 23llm-statsAuto-déclaré
LongBench v226,1 %15ᵉ / 15llm-statsAuto-déclaré
BFCL-V425,3 %13ᵉ / 13llm-statsAuto-déclaré
SuperGPQA21,3 %34ᵉ / 34llm-statsAuto-déclaré
IFBench21,0 %27ᵉ / 27llm-statsAuto-déclaré
Multi-Challenge18,9 %27ᵉ / 28llm-statsAuto-déclaré
GPQA11,9 %219ᵉ / 219llm-statsAuto-déclaré
t2-bench11,6 %23ᵉ / 23llm-statsAuto-déclaré
PolyMATH8,2 %23ᵉ / 23llm-statsAuto-déclaré
AA-LCR4,7 %15ᵉ / 15llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Notre analyse

Forces. Qwen3.5-0.8B réunit dans un nombre limité de paramètres une longue fenêtre de contexte, une couverture multilingue étendue et un fonctionnement multimodal vision-langage. Les modes Thinking et Non-Thinking offrent deux approches de génération. La publication des poids sous licence Apache 2.0 autorise leur adaptation et leur exploitation commerciale. Le modèle a suivi un pré-entraînement puis un post-entraînement, et son format Hugging Face Transformers fournit les poids ainsi que les fichiers de configuration nécessaires à son utilisation et à son fine-tuning.

Limites et points d'attention. À sa sortie, son classement sur GPQA, un benchmark consacré aux questions scientifiques de niveau avancé, le situait seulement dans le top 100% des 167 LLM de sa génération. Ce positionnement ne signale donc aucune avance particulière sur cette évaluation. Son format compact de 800 millions de paramètres constitue son principal positionnement, tandis que les usages prévus restent centrés sur le prototypage, le fine-tuning propre à une tâche, ainsi que la recherche et le développement.


Sources des données : LLM-Stats (llm-stats.com).