Qwen3.5-4B Qwen3.5-4B est un LLM multimodal de 4 milliards de paramètres publié par Qwen le 2 mars 2026. Son architecture hybride associe Gated Delta Networks, attention gated, FFN et encodeur visuel, avec une fusion précoce des tokens multimodaux.
Qwen3.5-9B Publié par Qwen le 2 mars 2026, Qwen3.5-9B est un modèle de langage causal de 9 milliards de paramètres, complété par un encodeur vision. Il prend en charge 201 langues et dialectes, ainsi que des usages de raisonnement, de codage, d’agents et de compréhension visuelle.
Magpie-Multilingual 357M (Feb 2026) Magpie-Multilingual 357M (Feb 2026) est un modèle de synthèse vocale publié par NVIDIA le 27 février 2026. Il transforme du texte en parole avec cinq voix couvrant neuf langues, dont le français, l’anglais, l’espagnol, le mandarin et le japonais.
gemini-3.1-flash-image-preview gemini-3.1-flash-image-preview est un LLM de Google. Son profil Benchable couvre le raisonnement, le code, les connaissances générales, l’éthique, la classification d’e-mails et les hallucinations.
ByteDance Seed: Seed-2.0-Mini ByteDance Seed: Seed-2.0-Mini est un LLM lancé par ByteDance Seed le 26 février 2026. Il se distingue par une fenêtre de contexte de 262 144 tokens et par un positionnement très économique, avec des tarifs inférieurs de 95% à la moyenne des LLM similaires.
LiquidAI: LFM2-24B-A2B Publié par Liquid le 25 février 2026, LiquidAI: LFM2-24B-A2B est un LLM instruct généraliste de la famille LFM2. Son architecture hybride MoE associe des couches convolutionnelles et attentionnelles, avec 24 milliards de paramètres au total, dont 2,3 milliards actifs.
Google: Gemini 3.1 Pro Preview Custom Tools Google: Gemini 3.1 Pro Preview Custom Tools est un LLM de Google sorti le 25 février 2026. Il se caractérise par une fenêtre de contexte de 1 048 756 tokens, soit environ 1,0 million, ainsi que par un positionnement économique.