LTX-2 Sorti le 4 février 2026, LTX-2 est un modèle de génération vidéo développé par Lightricks. Son profil privilégie la fluidité du mouvement et la qualité visuelle, deux dimensions situées dans la première moitié du classement VBench.
qwen3-coder-next-2025-02-03 Publié le 4 février 2026 par Alibaba Cloud et la Qwen Team, qwen3-coder-next-2025-02-03 est un LLM chinois à poids ouverts spécialisé dans les agents de programmation et le développement local. Son architecture hybride de 48 couches associe Gated DeltaNet, attention à portes et mélange…
Universal-3 Pro Universal-3 Pro est un modèle de reconnaissance vocale développé par AssemblyAI. Il convertit la parole en texte pour automatiser la production de transcriptions.
Step-3.5-Flash Publié par StepFun le 2 février 2026, Step-3.5-Flash est un LLM open-weights sous licence Apache 2.0, utilisable commercialement. Son positionnement associe une fenêtre de contexte de 262 144 tokens à un tarif très économique, inférieur de 95% à la moyenne des modèles similaires.
Eleven v3 Eleven v3 est un modèle de synthèse vocale d’ElevenLabs, sorti le 2 février 2026. Il transforme du texte en parole et propose quatre voix.
ICT-TIME-and-Querit/BOOM_4B_v1 Publié le 31 janvier 2026 par ICT-TIME-and-Querit, ICT-TIME-and-Querit/BOOM_4B_v1 est un modèle d’embedding textuel dense de 4 milliards de paramètres, tous actifs. Adapté de Qwen/Qwen3-4B, il produit des vecteurs de 2 560 dimensions et accepte une longueur de séquence de 32 000 tokens.
Grok Imagine Image grok-imagine-image est un modèle de génération d’images publié par xAI le 28 janvier 2026. Il produit des visuels à partir de descriptions textuelles et prend également en charge l’édition d’images.