Eleven v4 arrive : ce qui change pour les voix off et les agents
Eleven v4 et v4 Turbo sont disponibles : différences avec v3, voix clonées, limites et coût de 100 000 caractères, sans confondre API et abonnement.
Sommaire
ElevenLabs a lancé Eleven v4 et v4 Turbo le 28 septembre 2026. Le premier vise la narration et les dialogues préparés ; le second, les échanges vocaux en temps réel. Tous deux sont accessibles dans ElevenCreative, ElevenAgents et l’API, selon l’annonce officielle, consultée le 01/10/2026. L’enjeu pour un créateur : obtenir une voix mieux dirigée, tout en vérifiant qu’elle reste cohérente avec ses productions existantes.
Cette actualité décrit le lancement et les conditions observées le 1er octobre 2026. La fiche ElevenLabs rassemble les abonnements et les autres fonctions de la plateforme.
Eleven v4 : ce qui change depuis v3
Deux différences sont directement documentées : la famille v4 couvre plus de 90 langues, contre plus de 70 pour v3, et v4 accepte jusqu’à 10 000 caractères par requête, contre 5 000 pour v3 (documentation des modèles, vérifiée le 01/10/2026).
Pour un script de formation, la marge supplémentaire peut éviter de couper un passage au milieu d’une explication. Elle ne dispense pas de travailler par scènes : corriger une phrase doit rester possible sans recommencer tout le chapitre.
Les consignes entre crochets restent disponibles. Une indication comme [whispers] ou [laughs] sert à diriger l’interprétation ; elle fonctionne avec v3 comme avec v4. Le changement de modèle n’oblige donc pas à repartir d’un script vide (aide sur les balises audio, consultée le 01/10/2026).
Le point à surveiller est le son de vos voix existantes. La documentation précise qu’un clone peut sonner sensiblement différemment sous v4. Elle indique aussi qu’en changeant de langue, le modèle vise un accent naturel dans la langue cible, au lieu de conserver automatiquement l’accent de la voix source (guide v4, consulté le 01/10/2026).
Pour une marque déjà identifiée par une voix, cette différence mérite une validation éditoriale. Une narration plus fluide peut être souhaitable ; un personnage dont l’accent fait partie de l’identité pose une autre question.
À écouter : l’annonce propose des extraits audio officiels, dont un enregistrement original suivi de sa version clonée. Comparez le timbre, les respirations et les fins de phrase. Ces exemples sont sélectionnés par ElevenLabs ; ils illustrent son annonce, pas le résultat garanti sur votre propre voix.
v4 ou v4 Turbo : deux besoins différents
| Votre projet | Version à examiner | Critère de décision |
|---|---|---|
| Voix off, livre audio, dialogue préparé | Eleven v4 | Qualité du passage après écoute et corrections |
| Assistant vocal ou personnage interactif | Eleven v4 Turbo | Temps de réponse dans l’application complète |
Cette répartition suit la documentation des modèles, consultée le 01/10/2026. Le prix inférieur de Turbo ne suffit pas à en faire le choix par défaut pour toutes les productions.
ElevenLabs annonce environ 100 ms de latence médiane d’inférence pour Turbo, et environ 150 ms avant la première parole dans son protocole, hors latence réseau (annonce du lancement, vérifiée le 01/10/2026). Ce n’est pas le délai total d’un assistant : la reconnaissance de la demande, la préparation de la réponse et le réseau s’ajoutent au parcours.

Mesures publiées par ElevenLabs dans son annonce, consultée le 01/10/2026 : scripts identiques, réglages par défaut, latence réseau retirée ; v4 Turbo en streaming WebSocket. Il s’agit des résultats de l’éditeur, pas d’un test indépendant ni du délai complet d’un assistant. Agrandir le graphique.
Autre limite pour les développeurs : dans le WebSocket Text to Dialogue, v4 accepte jusqu’à dix voix enregistrées par connexion, Turbo une seule. La distinction concerne cet accès API, pas le nombre de voix de votre bibliothèque (comparaison des WebSockets, vérifiée le 01/10/2026).
Combien coûtent 100 000 caractères par API ?
Voici un calcul, pour un lot total de 100 000 caractères générés une fois, réparti en requêtes adaptées. Les montants sont en dollars, hors taxes, d’après les tarifs API vérifiés le 01/10/2026.
| Modèle | Tarif de référence pour 1 000 caractères | Tarif temporaire annoncé jusqu’au 12/10/2026 | Calcul pour 100 000 caractères : référence / promotion |
|---|---|---|---|
| v4 | 0,08 $ | 0,022 $ | 8 $ / 2,20 $ |
| v4 Turbo | 0,04 $ | 0,011 $ | 4 $ / 1,10 $ |
Calcul : 100 000 ÷ 1 000 × tarif. Les corrections qui entraînent de nouvelles générations augmentent le volume à chiffrer. Pour prévoir un budget après l’offre de lancement, gardez la colonne de référence ; la remise ne constitue pas un tarif permanent.
Ce tableau ne chiffre pas un abonnement créateur, ni un agent vocal complet. Il isole la synthèse du texte par API. Pour une production réelle, ajoutez votre réserve de reprises et les éventuels autres services utilisés.
Quel accès pour un créateur ?
Dans l’application, l’offre gratuite comporte 10 000 crédits mensuels. Starter coûte 6 $ par mois hors taxes et ajoute notamment la licence commerciale et le clonage instantané (tarifs Creative, vérifiés le 01/10/2026). Ces quotas ne sont pas les tarifs API du tableau.
Pour prendre en main le modèle dans l’interface, le tutoriel de création de voix ElevenLabs explique comment préparer un texte et choisir une voix.
Essayer ElevenLabs — lien affilié : une commission peut être versée à Génie Artificiel si vous souscrivez, sans surcoût pour vous.
Faut-il refaire les anciennes voix off ?
Pas sur le seul critère du numéro de version. Prenez un passage représentatif de votre projet : une phrase neutre, un changement d’émotion, un nom propre et une phrase longue. Comparez ensuite l’articulation, le ton et la continuité avec les vidéos déjà publiées. Un gain sur un extrait spectaculaire peut compter moins qu’une voix homogène sur une série entière.
Le changement ne retouche pas magiquement les fichiers existants : dans Audiobooks, choisir un autre modèle impose de régénérer les passages concernés pour modifier leur son, ce qui consomme des crédits (guide Audiobooks, consulté le 01/10/2026).
Enfin, Eleven v4, Studio 4.0 et Dubbing v2 désignent trois choses différentes. Studio 4.0 est l’éditeur de montage annoncé le 21 septembre ; Dubbing v2 est le modèle de traduction audio et vidéo, encore présenté en alpha, sans éditeur dans l’application au 1er octobre (annonce Studio, documentation Dubbing). Pour traduire un fichier existant, suivez le guide traduire une vidéo en gardant sa voix : sélectionner une voix v4 ne remplace pas ce parcours.
Questions fréquentes
Eleven v4 prend-il en charge le français ?
Oui, le français figure dans les langues documentées pour la famille v4. Pour une voix de marque, contrôlez aussi l’accent et la prononciation sur votre script, au-delà de la simple présence de la langue (modèles, vérifiés le 01/10/2026).
Les anciens réglages se retrouvent-ils tous dans v4 ?
Non. Le guide v4 décrit Stability et Similarity, mais pas de curseurs Style ou Speed ni de prise en charge du SSML. Un ancien script utilisant des pauses SSML doit être revu (guide v4, consulté le 01/10/2026).
La remise API s’applique-t-elle aussi aux crédits de l’application ?
Ce sont deux offres distinctes. Au 01/10/2026, Creative annonce, jusqu’au 12 octobre 2026, sur Creator et au-delà un volume de générations v4 non décompté, plafonné à deux fois le quota mensuel TTS, uniquement sur le web et le mobile. Ce n’est pas un tarif API ni un triplement permanent de tous les crédits (conditions affichées).