Speech 2.8 Turbo
Lancé par MiniMax le 14 février 2026, Speech 2.8 Turbo est un modèle de synthèse vocale qui transforme du texte en parole. Son catalogue comprend quatre voix, une sélection destinée à couvrir plusieurs besoins de production audio.
Lancé par MiniMax le 14 février 2026, Speech 2.8 Turbo est un modèle de synthèse vocale qui transforme du texte en parole. Son catalogue comprend quatre voix, une sélection destinée à couvrir plusieurs besoins de production audio.
Le modèle se situe dans le haut du classement Arena text-to-speech, fondé sur la préférence humaine. Son tarif d’entrée se place dans la moyenne des modèles comparables, tandis que la génération en sortie est annoncée gratuite.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Synthèse vocale (text-to-speech) |
| Éditeur | MiniMax |
| Poids | ▫ n.d. |
| Date de sortie | 14 février 2026 |
| Voix disponibles | 4 |
| Modalités (entrée → sortie) | text → speech |
Classements Arena (Elo)
Arena Text-to-Speech · 88 modèles classés
| Rang | Modèle | Elo |
|---|---|---|
| 1ᵉ | Gemini 3.1 Flash TTS | 1309 |
| 2ᵉ | Realtime TTS 1.5 Max | 1296 |
| 3ᵉ | Luna TTS | 1271 |
| ⋯ | ⋯ | |
| 28ᵉ | Maya1 | 1127 |
| 29ᵉ | Gemini 2.5 Flash Lite TTS | 1125 |
| 30ᵉ | Speech 2.8 Turbo | 1124 |
| 31ᵉ | Voxtral TTS | 1120 |
| 32ᵉ | Journey | 1115 |
Tarifs
| Fournisseur | Entrée / 1M | Sortie / 1M | Cache lecture / 1M |
|---|---|---|---|
| MiniMax | 60 $ | gratuit | n.d. |
Prix en dollars US par million de tokens.
Sa tarification se situe 100 % en dessous de la moyenne des modèles similaires.
Notre analyse
Forces. Speech 2.8 Turbo occupe une position élevée dans une Arena qui compte 88 modèles. Ce classement constitue un signal favorable pour le naturel et l’agrément perçus lors des comparaisons humaines. Les quatre voix permettent d’affecter plusieurs identités vocales à des contenus ou à des personnages distincts. La gratuité annoncée pour la sortie peut aussi contenir le coût des productions audio.
Limites et points d’attention. Dans l’Arena, Speech 2.8 Turbo se place derrière Gemini 3.1 Flash TTS, Realtime TTS 1.5 Max et Luna TTS. Gemini 3.1 Flash TTS est nettement devant dans les préférences humaines. Le catalogue de quatre voix restreint également la variété disponible pour les projets qui exigent de nombreux timbres. Usages pertinents : voix off, assistants vocaux, doublage et dispositifs d’accessibilité fondés sur la lecture à voix haute.
Sources des données : Artificial Analysis (artificialanalysis.ai) · LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai).