Maya 2 Global

Maya 2 Global est un modèle de synthèse vocale de Maya Research, sorti le 17 juillet 2026. Il transforme du texte en parole et propose quatre voix, ce qui permet de varier l’identité vocale selon le contenu.

Maya 2 Global est un modèle de synthèse vocale de Maya Research, sorti le 17 juillet 2026. Il transforme du texte en parole et propose quatre voix, ce qui permet de varier l’identité vocale selon le contenu.

Le modèle se situe dans le milieu du classement Arena text-to-speech. Il se place derrière Luna TTS, Gemini 3.1 Flash TTS et Realtime TTS 1.5 Max. Luna TTS est nettement devant dans les préférences humaines en duel.

Caractéristiques

CaractéristiqueValeur
TypeSynthèse vocale (text-to-speech)
ÉditeurMaya Research
Poids▫ n.d.
Date de sortie17 juillet 2026
Voix disponibles4

Classements Arena (Elo)

Arena Text-to-Speech · 91 modèles classés

RangModèleElo
1ᵉLuna TTS1328
2ᵉGemini 3.1 Flash TTS1320
3ᵉRealtime TTS 1.5 Max1288
31ᵉSpeech 02 HD1137
32ᵉTTS-11137
33ᵉMaya 2 Global1135
34ᵉSpeech 2.8 Turbo1132
35ᵉJourney1130

Notre analyse

Forces. Maya 2 Global offre quatre voix pour adapter la restitution à plusieurs formats ou personnages. Cette sélection convient aux projets qui demandent quelques identités vocales distinctes, par exemple une voix principale et plusieurs rôles secondaires. Son classement Arena le situe au milieu d’un ensemble de 91 modèles, ce qui fournit un repère direct sur la préférence humaine pour ses productions vocales.

Limites et points d’attention. Maya 2 Global reste en retrait des modèles placés en tête de l’Arena. Son écart avec Luna TTS est important, tandis que Gemini 3.1 Flash TTS et Realtime TTS 1.5 Max occupent également de meilleures positions. Les quatre voix peuvent aussi restreindre les projets de doublage qui exigent une distribution vocale étendue. Usages pertinents : voix off avec une distribution resserrée, assistants vocaux, doublage de quelques personnages et contenus d’accessibilité ; pour un résultat plus abouti, on lui préférera Luna TTS, Gemini 3.1 Flash TTS ou Realtime TTS 1.5 Max.


Sources des données : Artificial Analysis (artificialanalysis.ai).