Google: Chirp 3 Google: Chirp 3 est un modèle de reconnaissance vocale de Google, sorti le 5 mai 2026. Il convertit la parole en texte et relève d’un positionnement tarifaire premium.
Realtime TTS-2 - Research Preview Realtime TTS-2 - Research Preview est un modèle de synthèse vocale d’Inworld, sorti le 5 mai 2026. Il transforme du texte en parole et propose huit voix.
OpenAI: GPT Chat Latest OpenAI: GPT Chat Latest est un LLM propriétaire lancé le 5 mai 2026. Positionné sur le segment premium, il se caractérise par une fenêtre de contexte de 400 000 tokens, adaptée au traitement de volumes de texte importants.
Sonic 3.5 Sonic 3.5 est un modèle de synthèse vocale de Cartesia, sorti le 4 mai 2026. Il transforme du texte en parole et propose huit voix, un choix adapté à la production de contenus audio aux identités vocales distinctes.
DataScience-UIBK/Argus-Colqwen3.5-2b-v0 Publié le 3 mai 2026 par DataScience-UIBK, Argus-Colqwen3.5-2b-v0 est un modèle d’embedding de 2 milliards de paramètres, tous actifs. Il produit des représentations multi-vecteurs de dimension 1024 et applique une interaction tardive MaxSim inspirée de ColPali et ColBERT.
ICT-TIME-and-Querit/ICT-TIME-and-Querit-embedding-v1 ICT-TIME-and-Querit/ICT-TIME-and-Querit-embedding-v1 est un modèle d’embedding dense de 4 milliards de paramètres, publié par ICT-TIME-and-Querit le 2 mai 2026 sous licence ouverte Apache 2.0. Adapté de Qwen/Qwen3-4B, il produit des vecteurs de 2 560 dimensions et accepte une longueur de…
OpenAI: GPT-4o Mini Transcribe OpenAI: GPT-4o Mini Transcribe est un modèle de reconnaissance vocale édité par OpenAI et sorti le 1er mai 2026. Il convertit la parole en texte pour automatiser des tâches de transcription.