PlayHT ha chiuso definitivamente il 31 dicembre 2025. Meta ha acquisito il team di PlayAI a luglio 2025, l’API è andata offline prima della fine dello stesso mese e l’intera piattaforma, inclusi lo studio play.ht e Voice Agents, ha chiuso a fine anno (la nostra nota dell’epoca). Non esiste più un servizio a cui accedere. Alla chiusura, PlayHT ha eliminato account, audio salvati e cloni vocali senza offrire strumenti di esportazione; nel 2026 il dominio play.ht ha smesso di essere risolto. Una guida alla migrazione pubblicata dopo la chiusura raccoglie i dettagli.
Qui un’alternativa non è quindi uno strumento simile a cui passare quando vuoi. Devi ricostruire integrazione, file audio e voci presso un fornitore ancora attivo.
Cosa può ancora recuperare una migrazione da PlayHT
La tua integrazione. Gli endpoint sono offline da fine luglio 2025, quindi il codice che chiamava PlayHT non funziona più. Sostituiscilo con l’API del nuovo fornitore e verifica i percorsi che userai davvero, inclusi streaming, errori, nuovi tentativi e connessioni interrotte.
Il tuo audio. I file archiviati sui server di PlayHT sono stati eliminati alla chiusura. Quelli scaricati nel tuo spazio di archiviazione esistono ancora; rigenera gli altri dai copioni. Questa volta salva i risultati in uno spazio che controlli, qualunque fornitore tu scelga.
Le tue voci. I cloni vocali sono stati eliminati e non possono essere esportati. Ricreali dalle registrazioni originali. Dieci secondi di audio di una sola persona permettono di iniziare con un Instant Voice Clone; trenta minuti o più permettono di addestrare un Pro Voice Clone che conserva meglio accenti e caratteristiche distintive. Ripeti il procedimento per ogni voce ancora necessaria. La guida alla registrazione spiega cosa rende utilizzabile un clip.
Cosa confrontare
Se stai lasciando PlayHT, parti da ciò che devi conservare: copioni, identità vocale, formati audio e comportamento dell’integrazione API. Un nuovo catalogo di voci è solo una parte della migrazione.
Per un’applicazione, valuta un’API TTS come Sonic. Per audio prodotto manualmente, confronta editor e flussi di esportazione. Conferma disponibilità e supporto attuali di ogni servizio prima di creare una nuova dipendenza. Dopo una chiusura, questa verifica non è una formalità: è proprio la disponibilità a essere cambiata.
Le opzioni seguenti coprono attività diverse e non costituiscono una classifica di benchmark. Prima di impegnarti, verifica la disponibilità attuale, le funzioni e le condizioni dei piani di ciascun fornitore.
Le alternative a colpo d’occhio
| Prodotto | Da valutare per | Da verificare prima della scelta |
|---|---|---|
| Cartesia | Parlato per applicazioni vocali | Requisiti di modello, lingua e integrazione |
| Murf AI | Voiceover da copione | Controlli di editing e diritti di esportazione |
| Speechify | Lettura ad alta voce dei documenti | Piano per app di lettura, studio o API |
| ElevenLabs | Generazione vocale e doppiaggio | Scelta del modello e limiti d’uso |
| Synthesia | Video con presentatori IA | Requisiti degli avatar ed esportazioni video |
| WellSaid Labs | Voiceover aziendali | Flusso di lavoro del team e copertura linguistica |
| Lovo AI | Narrazione e dialoghi registrati | Controlli di esecuzione e flusso di revisione |
| Descript | Editing multimediale basato sulla trascrizione | Flusso di editing e opzioni di esportazione |
| Fliki | Produzione dal copione al video | Editing delle scene e tempi della narrazione |
| Amazon Polly | TTS nelle applicazioni AWS | Motore vocale, regione e controlli supportati |
| Voicemaker | Clip audio da testo | Controlli vocali e limiti di download |
| Wavel AI | Doppiaggio e localizzazione | Revisione della traduzione e sincronizzazione |
| Speechelo | Voiceover da testo ad audio | Condizioni di acquisto e disponibilità API |
| NaturalReader | Ascolto di documenti | Supporto dei file e diritti personali o commerciali |
| Uberduck | Voci cantate sintetiche | Diritti sulle voci e usi consentiti |
Cartesia

Sviluppiamo Sonic, un modello di sintesi vocale per applicazioni vocali. Puoi trasmettere in streaming l’audio generato, selezionare una voce oppure usare la clonazione vocale con registrazioni che hai il permesso di utilizzare. Prova i tuoi testi nel playground prima di integrare l’API.
Per un agente vocale completo servono anche riconoscimento vocale e gestione della conversazione. Ink è il nostro modello di trascrizione vocale e Managed Agents è il nostro strumento per creare agenti vocali. Sonic da solo non ascolta chi chiama e non decide cosa dire.
Controlla copertura linguistica, requisiti API e prezzi per il modello e il piano che intendi usare. Misura il tempo di risposta nella tua applicazione: il transito in rete e il buffering della riproduzione contribuiscono a ciò che sente l’utente.
Murf AI

Murf AI offre un editor di voiceover per lavorare da copioni e abbinare la narrazione ai contenuti multimediali. Valutalo per materiali formativi e presentazioni registrate. Prova quanto editing richiede il copione e verifica se il piano include le esportazioni e l’accesso del team necessari.
Speechify

Speechify offre app di lettura che trasformano documenti e pagine web in audio. Se vuoi ascoltare testi esistenti, parti da questo flusso. Valuta separatamente i prodotti di lettura, studio e API: l’accesso a uno non dice cosa includa l’altro.
ElevenLabs

ElevenLabs offre strumenti di sintesi vocale, clonazione e doppiaggio, oltre a prodotti per applicazioni conversazionali. Confronta il modello e l’endpoint specifici che distribuiresti. Prova pronuncia e tempo di risposta con i tuoi copioni anziché considerare tutti i modelli intercambiabili.
Synthesia

Synthesia crea video con presentatori IA e narrazione. Valutalo quando il risultato finale richiede un presentatore sullo schermo. Per prodotti solo audio, verifica se un’API vocale eviterebbe di pagare funzioni video che non usi.
WellSaid Labs

WellSaid Labs si concentra sulla produzione di voiceover per contenuti aziendali, inclusi formazione e comunicazioni interne. Valuta come il team rivede i copioni e gestisce le modifiche alla pronuncia. Controlla la copertura linguistica e l’accesso API del piano che intendi usare.
Lovo AI

Lovo AI combina la generazione vocale con strumenti per produrre contenuti registrati. Provalo con dialoghi o narrazioni che richiedono cambi di interpretazione. Ascolta un copione completo, poi verifica come revisioni ed esportazioni commerciali rientrano nel piano.
Descript

Descript combina la trascrizione con l’editing audio e video basato sul testo. Valutalo se vuoi tagliare materiale registrato modificandone la trascrizione. Un’API vocale da sola non sostituisce quell’editor, quindi prova il flusso dalla registrazione all’esportazione prima di cambiare.
Fliki

Fliki trasforma i copioni in video con narrazione. Valutalo se vuoi assemblare immagini e parlato in un solo editor. Prima di scegliere un piano, prova quanto lavoro manuale serve per correggere scene, tempi e pronuncia.
Amazon Polly

Amazon Polly è il servizio di sintesi vocale di AWS. È da valutare se la tua applicazione usa già identità e fatturazione AWS. I motori vocali differiscono per copertura linguistica e controlli supportati, quindi verifica il motore che distribuirai anziché l’elenco generale delle funzioni del servizio.
Voicemaker

Voicemaker offre un’interfaccia di sintesi vocale con controlli sulla voce e sul parlato. Prova un copione breve per vedere se i controlli disponibili risolvono le tue esigenze di pronuncia o ritmo. Verifica formati di download, limiti d’uso e diritti commerciali del piano selezionato.
Wavel AI

Wavel AI offre strumenti per doppiaggio e voiceover. Per la localizzazione, prova traduzione e parlato come passaggi separati: una registrazione fluida può comunque contenere errori di traduzione. Includi nella valutazione sincronizzazione dei sottotitoli e revisione di madrelingua.
Speechelo

Speechelo è uno strumento per generare voiceover dal testo. Verifica cosa include l’acquisto attuale, soprattutto limiti d’uso e diritti commerciali. Se devi generare parlato dentro un’applicazione, controlla l’accesso API anziché presumere che un editor lo includa.
NaturalReader

NaturalReader offre strumenti per ascoltare documenti e generare parlato. Distingui la lettura personale dalla produzione audio commerciale quando confronti i piani. Prova i tipi di file che usi davvero: leggere un PDF scansionato richiede anche il riconoscimento del testo prima della sintesi vocale.
Uberduck

Uberduck si concentra su voci cantate sintetiche e usi di intrattenimento. Valutalo per progetti che richiedono specificamente questi risultati. Verifica i diritti di ogni voce e registrazione: la presenza di una voce in un catalogo non autorizza a impersonare chi la possiede.
Prova prima di cambiare
Salva testi di input rappresentativi e le impostazioni del modello attuale. Gli ID voce sono specifici del fornitore, quindi prevedi di selezionare o creare una voce sostitutiva con i diritti necessari. Confronta l’output alla frequenza di campionamento effettiva e prova errori, nuovi tentativi e streaming interrotti prima di spostare il traffico. Conserva anche copie di tutto ciò che generi.
Confronta i costi in base all’utilizzo previsto e alle funzioni necessarie. Includi nuovi tentativi, audio rigenerato, limiti di concorrenza e diritti commerciali. Un prezzo iniziale basso non è una stima del carico di lavoro.
