Speech 2.8 Turbo

Lancé par MiniMax le 14 février 2026, Speech 2.8 Turbo est un modèle de synthèse vocale qui transforme du texte en parole. Son catalogue comprend quatre voix, une sélection destinée à couvrir plusieurs besoins de production audio.

Lancé par MiniMax le 14 février 2026, Speech 2.8 Turbo est un modèle de synthèse vocale qui transforme du texte en parole. Son catalogue comprend quatre voix, une sélection destinée à couvrir plusieurs besoins de production audio.

Le modèle se situe dans le haut du classement Arena text-to-speech, fondé sur la préférence humaine. Son tarif d’entrée se place dans la moyenne des modèles comparables, tandis que la génération en sortie est annoncée gratuite.

Caractéristiques

CaractéristiqueValeur
TypeSynthèse vocale (text-to-speech)
ÉditeurMiniMax
Poids▫ n.d.
Date de sortie14 février 2026
Voix disponibles4
Modalités (entrée → sortie)text → speech

Classements Arena (Elo)

Arena Text-to-Speech · 88 modèles classés

RangModèleElo
1ᵉGemini 3.1 Flash TTS1309
2ᵉRealtime TTS 1.5 Max1296
3ᵉLuna TTS1271
28ᵉMaya11127
29ᵉGemini 2.5 Flash Lite TTS1125
30ᵉSpeech 2.8 Turbo1124
31ᵉVoxtral TTS1120
32ᵉJourney1115

Tarifs

FournisseurEntrée / 1MSortie / 1MCache lecture / 1M
MiniMax60 $gratuitn.d.

Prix en dollars US par million de tokens.

Sa tarification se situe 100 % en dessous de la moyenne des modèles similaires.

Notre analyse

Forces. Speech 2.8 Turbo occupe une position élevée dans une Arena qui compte 88 modèles. Ce classement constitue un signal favorable pour le naturel et l’agrément perçus lors des comparaisons humaines. Les quatre voix permettent d’affecter plusieurs identités vocales à des contenus ou à des personnages distincts. La gratuité annoncée pour la sortie peut aussi contenir le coût des productions audio.

Limites et points d’attention. Dans l’Arena, Speech 2.8 Turbo se place derrière Gemini 3.1 Flash TTS, Realtime TTS 1.5 Max et Luna TTS. Gemini 3.1 Flash TTS est nettement devant dans les préférences humaines. Le catalogue de quatre voix restreint également la variété disponible pour les projets qui exigent de nombreux timbres. Usages pertinents : voix off, assistants vocaux, doublage et dispositifs d’accessibilité fondés sur la lecture à voix haute.


Sources des données : Artificial Analysis (artificialanalysis.ai) · LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai).