Eleven v3
Eleven v3 est un modèle de synthèse vocale d’ElevenLabs, sorti le 2 février 2026. Il transforme du texte en parole et propose quatre voix.
Eleven v3 est un modèle de synthèse vocale d’ElevenLabs, sorti le 2 février 2026. Il transforme du texte en parole et propose quatre voix.
Le modèle se situe parmi les mieux classés de l’Arena text-to-speech, une évaluation fondée sur les préférences humaines. Il occupe la deuxième place du classement, derrière Simba 3.2. Ce positionnement repose sur deux sources de données concordantes.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Synthèse vocale (text-to-speech) |
| Éditeur | ElevenLabs |
| Poids | 🔒 Propriétaire |
| Date de sortie | 2 février 2026 |
| Voix disponibles | 4 |
Classements Arena (Elo)
Arena Text-to-Speech · 88 modèles classés
| Rang | Modèle | Elo |
|---|---|---|
| 1ᵉ | Gemini 3.1 Flash TTS | 1309 |
| 2ᵉ | Realtime TTS 1.5 Max | 1296 |
| 3ᵉ | Luna TTS | 1271 |
| ⋯ | ⋯ | |
| 31ᵉ | Voxtral TTS | 1120 |
| 32ᵉ | Journey | 1115 |
| 33ᵉ | Eleven v3 | 1114 |
| 34ᵉ | Gemini 2.5 Pro | 1113 |
| 35ᵉ | Gradium TTS (Jun 2026) | 1113 |
Tarifs
| Fournisseur | Entrée / 1M | Sortie / 1M | Cache lecture / 1M |
|---|---|---|---|
| elevenlabs | 7,5e+06 $ | n.d. | n.d. |
Prix en dollars US par million de tokens.
Sa tarification se situe 79 % en dessous de la moyenne des modèles similaires.
Notre analyse
Forces. Eleven v3 atteint le haut de l’Arena text-to-speech, avec une deuxième place parmi 89 modèles évalués. Ce classement constitue un signal direct de préférence humaine pour ses sorties vocales. Les quatre voix disponibles permettent de sélectionner plusieurs identités vocales selon le contenu produit. La concordance de deux sources de données renforce la fiabilité du positionnement rapporté.
Limites et points d’attention. Malgré son rang élevé, Eleven v3 ne domine pas l’Arena, Simba 3.2 conservant la première place avec un Elo supérieur. Son catalogue de quatre voix limite aussi l’étendue du choix vocal par rapport à des besoins nécessitant de nombreux profils distincts. Usages pertinents : création de voix off, assistants vocaux, doublage et solutions d’accessibilité reposant sur la lecture de texte.
Sources des données : Artificial Analysis (artificialanalysis.ai) · LLM-Stats (llm-stats.com).