PlayHT a fermé définitivement le 31 décembre 2025. Meta a acquis l’équipe de PlayAI en juillet 2025, l’API a été mise hors ligne avant la fin du mois et toute la plateforme, y compris le studio play.ht et Voice Agents, a fermé en fin d’année (notre note de l’époque). Il n’y a plus de service auquel se connecter. PlayHT a supprimé les comptes, les fichiers audio enregistrés et les clones vocaux à la fermeture, sans outil d’export, et le domaine play.ht a cessé de résoudre en 2026. Un guide de migration publié après la fermeture rassemble les détails.
Une alternative n’est donc pas ici un outil similaire vers lequel passer quand vous le souhaitez. Il faut reconstruire votre intégration, vos fichiers audio et vos voix chez un fournisseur encore en activité.
Ce qu’une migration depuis PlayHT permet encore de récupérer
Votre intégration. Les endpoints sont hors ligne depuis fin juillet 2025. Le code qui appelait PlayHT ne fonctionne donc plus. Remplacez-le par l’API du nouveau fournisseur et testez les parcours que vous utiliserez réellement, notamment le streaming, les erreurs, les nouvelles tentatives et les connexions interrompues.
Votre audio. Les fichiers stockés sur les serveurs de PlayHT ont été supprimés à la fermeture. Ceux que vous avez téléchargés dans votre propre stockage existent toujours ; régénérez le reste à partir de vos scripts. Cette fois, conservez les fichiers générés dans un espace que vous contrôlez, quel que soit le fournisseur choisi.
Vos voix. Les clones vocaux ont été supprimés et ne peuvent pas être exportés. Recréez-les à partir de vos enregistrements originaux. Dix secondes d’audio d’une seule personne permettent de commencer avec un Instant Voice Clone. Trente minutes ou plus permettent d’entraîner un Pro Voice Clone qui conserve mieux les accents et les particularités de la voix. Faites-le pour chaque voix encore nécessaire. Le guide d’enregistrement explique ce qui rend un extrait exploitable.
Les critères à comparer
Si vous quittez PlayHT, commencez par ce qu’il faut préserver : scripts, identité vocale, formats audio et comportement de l’intégration API. Un nouveau catalogue de voix ne représente qu’une partie de la migration.
Pour une application, évaluez une API TTS comme Sonic. Pour l’audio produit manuellement, comparez éditeurs et exports. Confirmez la disponibilité et l’assistance actuelles avant de créer une nouvelle dépendance. Après une fermeture, cette vérification n’est pas une formalité : c’est précisément la disponibilité qui a changé.
Les options ci-dessous répondent à différents besoins et ne constituent pas un classement de performances. Vérifiez la disponibilité, les fonctions et les conditions actuelles de chaque fournisseur avant de vous engager.
Les alternatives en un coup d’œil
| Produit | À évaluer pour | À vérifier avant de choisir |
|---|---|---|
| Cartesia | Parole pour applications vocales | Modèle, langue et intégration |
| Murf AI | Voix off scénarisées | Réglages de montage et droits d’export |
| Speechify | Lecture de documents à voix haute | Offre de lecture, studio ou API |
| ElevenLabs | Génération vocale et doublage | Choix du modèle et limites d’usage |
| Synthesia | Vidéos avec présentateur IA | Besoins d’avatar et exports vidéo |
| WellSaid Labs | Voix off d’entreprise | Travail d’équipe et langues |
| Lovo AI | Narration et dialogues enregistrés | Réglages d’interprétation et révision |
| Descript | Montage multimédia par transcription | Processus de montage et exports |
| Fliki | Production vidéo à partir de scripts | Montage des scènes et minutage de narration |
| Amazon Polly | TTS dans les applications AWS | Moteur vocal, région et commandes |
| Voicemaker | Extraits audio à partir de texte | Réglages vocaux et limites de téléchargement |
| Wavel AI | Doublage et localisation | Révision de traduction et minutage |
| Speechelo | Voix off à partir de texte | Conditions d’achat et disponibilité API |
| NaturalReader | Écoute de documents | Formats et droits personnels ou commerciaux |
| Uberduck | Voix chantées synthétiques | Droits vocaux et usages autorisés |
Cartesia

Nous développons Sonic, un modèle de synthèse vocale pour les applications. Vous pouvez diffuser l’audio généré en continu, choisir une voix ou cloner une voix à partir d’enregistrements que vous avez le droit d’utiliser. Essayez vos propres textes dans le playground avant d’intégrer l’API.
Un agent vocal complet demande aussi de la reconnaissance vocale et une gestion de la conversation. Ink est notre modèle de transcription audio, et Managed Agents notre outil de création d’agents vocaux. Sonic seul n’écoute pas les appelants et ne décide pas quoi répondre.
Vérifiez les langues prises en charge, les prérequis API et les tarifs du modèle et de l’offre envisagés. Mesurez le temps de réponse dans votre application : le réseau et la mise en mémoire tampon influencent ce que l’utilisateur entend.
Murf AI

Murf AI propose un éditeur de voix off pour travailler à partir de scripts et synchroniser narration et médias. Envisagez-le pour la formation et les présentations enregistrées. Testez le travail de montage nécessaire et vérifiez les exports et accès d’équipe compris dans l’offre.
Speechify

Speechify propose des applications de lecture qui convertissent documents et pages web en audio. Si vous voulez écouter du texte existant, commencez par cet usage. Évaluez séparément ses produits de lecture, de studio et d’API : l’accès à l’un ne dit pas ce que l’autre comprend.
ElevenLabs

ElevenLabs propose synthèse vocale, clonage et doublage, ainsi que des produits conversationnels. Comparez le modèle et le point de terminaison précis que vous déploieriez. Testez prononciation et temps de réponse avec vos scripts, sans considérer tous les modèles comme interchangeables.
Synthesia

Synthesia crée des vidéos avec présentateurs IA et narration. Évaluez-le si le résultat final doit montrer un présentateur. Pour un produit uniquement audio, une API vocale peut éviter de payer des fonctions vidéo inutiles.
WellSaid Labs

WellSaid Labs se concentre sur les voix off pour les contenus d’entreprise, notamment la formation et la communication interne. Évaluez la révision des scripts et les changements de prononciation par votre équipe. Vérifiez les langues et l’accès API de l’offre envisagée.
Lovo AI

Lovo AI associe génération vocale et outils de production de contenus enregistrés. Essayez-le sur un dialogue ou une narration dont l’interprétation doit changer. Écoutez un script entier, puis vérifiez les possibilités de révision et d’export commercial de votre offre.
Descript

Descript associe transcription et montage audio-vidéo par le texte. Envisagez-le pour couper des enregistrements en modifiant leur transcription. Une API vocale seule ne remplace pas cet éditeur : testez le parcours de l’enregistrement à l’export avant de changer.
Fliki

Fliki transforme les scripts en vidéos commentées. Envisagez-le pour assembler visuels et parole dans un même éditeur. Testez les retouches manuelles nécessaires sur les scènes, le minutage et la prononciation avant de choisir une offre.
Amazon Polly

Amazon Polly est le service de synthèse vocale d’AWS. Il mérite un test si votre application utilise déjà l’identité et la facturation AWS. Les moteurs vocaux diffèrent par leurs langues et commandes : vérifiez celui que vous comptez déployer plutôt que la liste globale des fonctions.
Voicemaker

Voicemaker propose une interface TTS avec des réglages de voix et de parole. Testez un script court pour vérifier si ses commandes répondent à vos besoins de prononciation ou de rythme. Vérifiez formats téléchargés, limites et droits commerciaux de l’offre choisie.
Wavel AI

Wavel AI propose doublage et voix off. Pour la localisation, testez séparément traduction et parole : un enregistrement fluide peut contenir une erreur de traduction. Incluez le minutage des sous-titres et la révision par un locuteur natif.
Speechelo

Speechelo génère des voix off à partir de texte. Vérifiez le contenu de l’achat actuel, notamment les limites d’usage et les droits commerciaux. Pour générer de la parole dans une application, confirmez l’accès API au lieu de supposer qu’un éditeur le comprend.
NaturalReader

NaturalReader propose des outils de lecture de documents et de génération vocale. Distinguez lecture personnelle et production audio commerciale dans la comparaison des offres. Testez vos formats réels : un PDF numérisé demande aussi une reconnaissance du texte avant la synthèse.
Uberduck

Uberduck se concentre sur les voix synthétiques pour le divertissement. Évaluez-le pour un projet qui a précisément ce besoin. Vérifiez les droits de chaque voix et enregistrement : la présence dans un catalogue n’autorise pas à usurper l’identité du locuteur.
Tester avant de changer
Conservez des textes représentatifs et vos réglages actuels. Les identifiants de voix sont propres à chaque fournisseur : prévoyez de choisir ou créer une voix de remplacement avec les droits nécessaires. Comparez à votre fréquence d’échantillonnage réelle et testez erreurs, nouvelles tentatives et flux interrompus avant de basculer le trafic. Gardez aussi une copie de tout ce que vous générez.
Comparez les coûts à partir du volume prévu et des fonctions nécessaires. Incluez les nouvelles tentatives, l’audio régénéré, les limites de concurrence et les droits commerciaux. Un prix d’entrée bas n’est pas une estimation de votre charge.
