QWQ-Plus QWQ-Plus est un LLM de Qwen sorti le 8 avril 2025. Âgé de près d’un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, où les modèles évoluent rapidement et peuvent disparaître des catalogues.
cl-nagoya/ruri-v3-30m Publié par cl-nagoya le 7 avril 2025, cl-nagoya/ruri-v3-30m est un modèle d’embedding japonais généraliste fondé sur ModernBERT-Ja. Ses 37 millions de paramètres, tous actifs, produisent un vecteur dense de 256 dimensions par pooling moyen. Il traite des séquences allant jusqu’à 8 192…
Llama 3.1 Nemotron Ultra 253B v1 Publié par NVIDIA le 7 avril 2025, Llama 3.1 Nemotron Ultra 253B v1 est déjà ancien à l’échelle de l’IA. Issu de Llama 3.1 405B Instruct, ce LLM dense de 253 milliards de paramètres a été remanié par recherche d’architecture afin d’intégrer des blocs non standard.
Llama 4 Maverick Publié par Meta le 5 avril 2025, Llama 4 Maverick est déjà ancien à l’échelle de l’IA. Environ un an après sa sortie, ses performances sont largement dépassées et le modèle est souvent absent du catalogue de l’éditeur.
Llama 4 Scout Sorti le 5 avril 2025, Llama 4 Scout est un LLM de Meta qui accuse déjà une ancienneté importante à l’échelle de l’IA. Ses 109 milliards de paramètres et sa fenêtre de contexte de 10 millions de tokens le distinguent, mais ses performances sont désormais probablement dépassées par celles…
Midjourney v7 Alpha Midjourney v7 Alpha est un modèle de génération d’images à partir de descriptions textuelles, publié par Midjourney le 3 avril 2025. Il vise notamment la création d’illustrations, de concepts visuels, de designs et de contenus publicitaires.
nomic-ai/colnomic-embed-multimodal-3b Publié par Nomic AI le 31 mars 2025, nomic-ai/colnomic-embed-multimodal-3b est un modèle d’embedding multimodal de 3 milliards de paramètres actifs, affiné à partir de Qwen2.5-VL 3B Instruct. Son architecture vision-langage traite du texte, des images entrelacées et des images de pages…