Kimi K2-Instruct-0905 Kimi K2-Instruct-0905 est un LLM de Moonshot AI sorti le 5 septembre 2025. Son échelle constitue son trait distinctif principal, avec 1000 milliards de paramètres.
google/embeddinggemma-300m Publié par Google le 4 septembre 2025, google/embeddinggemma-300m est un modèle d’embedding dense de 308 millions de paramètres, tous actifs. Il produit des vecteurs de 768 dimensions et est distribué sous licence Gemma.
Mistral Large 3 Mistral Large 3 est un LLM open-weights publié par Mistral AI le 1 septembre 2025. Ses 675 milliards de paramètres le placent parmi les modèles de très grande taille, tandis que sa fenêtre de contexte atteint 128 000 tokens.
LongCat-Flash-Chat Publié par Meituan en août 2025, LongCat-Flash-Chat est un LLM conversationnel non-thinking à poids ouverts, sous licence MIT avec usage commercial autorisé. Son architecture Mixture-of-Experts réunit 560 milliards de paramètres, mais n’en active dynamiquement qu’environ 18,6 à 31,3…
Grok 4 Fast Grok 4 Fast est un LLM propriétaire de xAI, lancé le 28 août 2025. Il se distingue par un positionnement très économique et par une fenêtre de contexte de 2 millions de tokens, conçue pour absorber de très grands volumes de texte au sein d’une même requête.
Grok Code Fast 1 Grok Code Fast 1 est un LLM propriétaire de xAI, sorti le 28 août 2025 et positionné sur le code. Il associe une fenêtre de contexte de 256 000 tokens à une tarification très économique, pensée pour traiter de gros volumes à faible coût.
Qwen: Qwen3 30B A3B Thinking 2507 Qwen: Qwen3 30B A3B Thinking 2507 est un LLM à poids ouverts d’Alibaba Cloud et de la Qwen Team, sorti le 28 août 2025. Son architecture Qwen3-MoE compte 30,5 milliards de paramètres, dont 3,3 milliards activés, avec 8 experts mobilisés parmi 128.