Inception
Des modèles de langage par diffusion conçus pour une génération rapide et une intégration par API
Inception est une entreprise américaine d’intelligence artificielle issue de travaux universitaires menés à Stanford, notamment autour de Stefano Ermon. Elle développe une nouvelle génération de modèles de langage fondés sur la diffusion, une méthode d’abord popularisée dans la création d’images. Sa mission consiste à rendre la génération de texte plus rapide et plus efficace en produisant plusieurs éléments en parallèle, plutôt qu’en suivant exclusivement l’approche autorégressive traditionnelle.
Dans le catalogue, l’offre d’Inception est représentée par Mercury 2, proposé sous forme de service propriétaire accessible par API. Aucun poids de modèle n’est publié. Mercury 2 se distingue par une fenêtre de contexte étendue et constitue le modèle de l’éditeur disposant de la couverture de benchmarks la plus complète. Cette fiche illustre un positionnement centré sur la vitesse d’inférence, la faible latence et l’intégration dans des applications nécessitant des réponses rapides.
Les modèles d’Inception ciblent notamment les assistants conversationnels, les outils de programmation, les agents logiciels et les services génératifs déployés à grande échelle.