Gradium TTS Beta Gradium TTS Beta est un modèle de synthèse vocale développé par Gradium et sorti le 30 juillet 2026. Il transforme du texte en parole et propose quatre voix.
MiniMax H3 MiniMax H3 est un modèle de génération vidéo de MiniMax, sorti le 30 juillet 2026 avec des poids ouverts. Il traite des contextes mêlant texte, images, vidéo et audio, puis produit des séquences accompagnées d’un son stéréo natif.
Thinking Machines: Inkling Small Thinking Machines: Inkling Small est un LLM multimodal à poids ouverts, lancé le 30 juillet 2026. Sa fenêtre de contexte de 524 288 tokens et son positionnement très économique le destinent au traitement de volumes importants de texte, d’images et d’audio.
Claude Opus 5 Claude Opus 5 est un LLM propriétaire d’Anthropic, sorti le 24 juillet 2026. Positionné sur le segment premium, il se distingue par une fenêtre de contexte de 1 million de tokens et par des résultats de premier plan en mathématiques, en sciences et dans plusieurs arènes spécialisées.
Qwen: Qwen-Audio-3.0-TTS Flash Qwen: Qwen-Audio-3.0-TTS Flash est un modèle de synthèse vocale édité par Qwen et sorti le 23 juillet 2026. Il transforme du texte en parole pour produire des contenus audio à partir de scripts ou de réponses écrites.
Microsoft: MAI-Voice-2-Flash Microsoft: MAI-Voice-2-Flash est un modèle de synthèse vocale de Microsoft. Il transforme du texte en parole et sa sortie est fixée au 23 juillet 2026. Son positionnement économique cible les projets qui accordent une place importante au coût de génération.
Microsoft: MAI-Image-2.5 Pro Microsoft: MAI-Image-2.5 Pro est un modèle de génération d’images à partir de descriptions textuelles, édité par Microsoft et sorti le 23 juillet 2026. Il cible notamment l’illustration, le design visuel et la création publicitaire.