Aprende

15 alternativas a PlayHT tras su cierre

Rene, Chang Chen 
15 alternativas a PlayHT tras su cierre

PlayHT cerró definitivamente el 31 de diciembre de 2025. Meta adquirió el equipo de PlayAI en julio de 2025, la API dejó de funcionar antes de acabar ese mes y toda la plataforma, incluidos el estudio de play.ht y Voice Agents, cerró al terminar el año (nuestra nota de entonces). Ya no hay ningún servicio al que iniciar sesión. PlayHT eliminó las cuentas, el audio guardado y los clones de voz al cerrar, sin ofrecer una herramienta de exportación, y el dominio play.ht dejó de resolver en 2026. Una guía de migración publicada después del cierre reúne los detalles.

Aquí, una alternativa no es una herramienta similar a la que puedas pasarte cuando quieras. Tienes que reconstruir tu integración, tus archivos de audio y tus voces con un proveedor que siga existiendo.

Qué puedes recuperar al migrar desde PlayHT

Tu integración. Los endpoints están fuera de servicio desde finales de julio de 2025, así que el código que llamaba a PlayHT ya no sirve. Sustitúyelo por la API del nuevo proveedor y prueba los casos que utilizarás, incluidos streaming, errores, reintentos y conexiones interrumpidas.

Tu audio. Los archivos almacenados en los servidores de PlayHT se eliminaron al cerrar. Lo que descargaste a tu propio almacenamiento sigue existiendo; vuelve a generar el resto a partir de tus guiones. Esta vez guarda los resultados en un lugar que controles, sea cual sea el proveedor que elijas.

Tus voces. Los clones de voz se eliminaron y no pueden exportarse, así que vuelve a crearlos a partir de tus grabaciones originales. Diez segundos de audio de una sola persona bastan para empezar con un Instant Voice Clone, y con treinta minutos o más se entrena un Pro Voice Clone que conserva mejor los acentos y los rasgos distintivos. Hazlo con cada voz que aún necesites; la guía de grabación explica qué debe tener un clip utilizable.

Qué comparar

Si abandonas PlayHT, empieza por lo que debes conservar: guiones, identidad de voz, formatos de audio y comportamiento de la integración de API. Un nuevo catálogo de voces es solo una parte de la migración.

Para una aplicación, evalúa una API de TTS como Sonic. Para audio producido manualmente, compara editores y procesos de exportación. Confirma la disponibilidad y el soporte actuales de cualquier servicio antes de crear una nueva dependencia de él. Tras un cierre, esa comprobación no es una formalidad: la disponibilidad es precisamente lo que ha cambiado.

Las siguientes opciones resuelven tareas distintas; no son una clasificación de rendimiento. Comprueba la disponibilidad, las funciones y las condiciones actuales de cada proveedor antes de comprometerte.

Las alternativas de un vistazo

ProductoPara qué evaluarloQué comprobar antes de elegir
CartesiaHabla para aplicaciones de vozRequisitos de modelo, idioma e integración
Murf AILocuciones a partir de guionesControles de edición y derechos de exportación
SpeechifyLectura de documentos en voz altaPlan de aplicación de lectura, estudio o API
ElevenLabsGeneración de voz y doblajeElección de modelo y límites de uso
SynthesiaVídeos con presentadores de IARequisitos de avatares y exportaciones de vídeo
WellSaid LabsLocuciones empresarialesFlujo de trabajo del equipo y cobertura de idiomas
Lovo AINarración y diálogo grabadosControles de interpretación y proceso de revisión
DescriptEdición multimedia basada en transcripcionesFlujo de edición y opciones de exportación
FlikiProducción de vídeo a partir de guionesEdición de escenas y tiempos de narración
Amazon PollyTTS en aplicaciones de AWSMotor de voz, región y controles compatibles
VoicemakerClips de audio a partir de textoControles de habla y límites de descarga
Wavel AIDoblaje y localizaciónRevisión de traducciones y tiempos
SpeecheloLocuciones a partir de guionesCondiciones de compra y disponibilidad de la API
NaturalReaderEscucha de documentosCompatibilidad de archivos y derechos personales frente a comerciales
UberduckVoces cantadas sintéticasDerechos de voz y usos permitidos

Cartesia

Panel de Cartesia con accesos a Managed Agents y texto a voz, voces destacadas y claves de API

Desarrollamos Sonic, un modelo de texto a voz para aplicaciones de voz. Puedes transmitir el audio generado, seleccionar una voz o clonar voces a partir de grabaciones que tengas permiso para usar. Prueba tu propio texto en el entorno de pruebas antes de integrar la API.

Un agente de voz completo también necesita reconocimiento de voz y gestión de conversaciones. Ink es nuestro modelo de voz a texto y Managed Agents, nuestra herramienta para crear agentes de voz. Sonic por sí solo no escucha a quienes llaman ni decide qué decir.

Comprueba la cobertura de idiomas, los requisitos de la API y los precios del modelo y el plan que quieras usar. Mide el tiempo de respuesta en tu aplicación. El recorrido por la red y los búferes de reproducción influyen en lo que oye el usuario.

Murf AI

Murf AI

Murf AI tiene un editor de locuciones para trabajar con guiones y sincronizar la narración con contenido multimedia. Considéralo para materiales de formación y presentaciones grabadas. Prueba cuánta edición necesita tu guion y comprueba si el plan incluye las exportaciones y el acceso de equipo que necesitas.

Speechify

Speechify

Speechify ofrece aplicaciones de lectura que convierten documentos y páginas web en audio. Si quieres escuchar texto existente, empieza por ese flujo. Evalúa por separado sus productos de lectura, estudio y API. Tener acceso a uno no indica qué incluye otro.

ElevenLabs

ElevenLabs

ElevenLabs ofrece herramientas de texto a voz, clonación de voz y doblaje, además de productos para aplicaciones conversacionales. Compara el modelo y el endpoint concretos que desplegarías. Prueba la pronunciación y el tiempo de respuesta con tus propios guiones en vez de tratar todos los modelos como intercambiables.

Synthesia

Synthesia

Synthesia crea vídeos con presentadores de IA y narración. Evalúalo cuando el resultado final necesite un presentador en pantalla. Para productos de solo audio, comprueba si una API de voz te evitaría pagar por funciones de vídeo que no usas.

WellSaid Labs

WellSaid Labs

WellSaid Labs se centra en producir locuciones para contenido empresarial, como formación y comunicaciones internas. Evalúa cómo revisa tu equipo los guiones y gestiona los cambios de pronunciación. Comprueba la cobertura de idiomas y el acceso a la API del plan que quieras usar.

Lovo AI

Lovo AI

Lovo AI combina generación de voz con herramientas para producir contenido grabado. Pruébalo con diálogos o narraciones que requieran cambios de interpretación. Escucha un guion completo y comprueba después cómo encajan las revisiones y las exportaciones comerciales en tu plan.

Descript

Descript

Descript combina transcripción con edición de audio y vídeo basada en texto. Considéralo cuando quieras recortar material grabado editando su transcripción. Una API de voz por sí sola no sustituye ese editor. Prueba todo el proceso, desde la grabación hasta la exportación, antes de cambiar.

Fliki

Fliki

Fliki convierte guiones en vídeos con narración. Considéralo cuando quieras montar imágenes y voz en un solo editor. Prueba cuánto trabajo manual requieren las correcciones de escenas, tiempos y pronunciación antes de elegir un plan.

Amazon Polly

Amazon Polly

Amazon Polly es el servicio de texto a voz de AWS. Conviene evaluarlo si tu aplicación ya usa la identidad y la facturación de AWS. Los motores de voz difieren en cobertura de idiomas y controles compatibles. Comprueba el motor que desplegarás en lugar de la lista de funciones de todo el servicio.

Voicemaker

Voicemaker

Voicemaker tiene una interfaz de texto a voz con controles de voz y habla. Prueba un guion breve para ver si sus controles disponibles resuelven tus necesidades de pronunciación o ritmo. Verifica los formatos de descarga, los límites de uso y los derechos comerciales del plan elegido.

Wavel AI

Wavel AI

Wavel AI ofrece herramientas de doblaje y locución. Para localizar contenido, prueba la traducción y el habla como pasos separados. Una grabación fluida puede contener una traducción incorrecta. Incluye los tiempos de los subtítulos y la revisión de hablantes nativos en tu evaluación.

Speechelo

Speechelo

Speechelo es una herramienta para generar locuciones a partir de texto. Comprueba qué incluye actualmente la compra, en especial los límites de uso y los derechos comerciales. Si necesitas generar voz dentro de una aplicación, verifica el acceso a una API en lugar de asumir que el editor lo incluye.

NaturalReader

NaturalReader

NaturalReader tiene herramientas para escuchar documentos y generar habla. Distingue la lectura personal de la producción comercial de audio al comparar planes. Prueba los tipos de archivo que realmente usas. Leer un PDF escaneado también requiere reconocer el texto antes de sintetizar la voz.

Uberduck

Uberduck

Uberduck se centra en voces cantadas sintéticas y usos de entretenimiento. Evalúalo para un proyecto que necesite específicamente esos resultados. Comprueba los derechos de cada voz y grabación. Que una voz aparezca en un catálogo no da permiso para suplantar a quien la presta.

Prueba antes de cambiar

Guarda textos de entrada representativos y los ajustes actuales del modelo. Los identificadores de voz son específicos de cada proveedor, así que prevé seleccionar o crear una voz sustituta con los derechos necesarios. Compara la salida a tu frecuencia de muestreo real y prueba errores, reintentos y flujos interrumpidos antes de cambiar el tráfico. Conserva también copias de todo lo que generes.

Compara costes según tu uso previsto y las funciones que necesitas. Incluye reintentos, audio regenerado, límites de concurrencia y derechos comerciales. Un precio inicial bajo no es una estimación de tu carga de trabajo.

Prueba Sonic con tu propio texto.

Preguntas frecuentes

¿Qué pasó con PlayHT?

Meta adquirió el equipo de PlayAI en julio de 2025. La API dejó de funcionar pocas semanas después y toda la plataforma, incluidos play.ht, la API y Voice Agents, cerró el 31 de diciembre de 2025. Cartesia documentó el cierre mientras ocurría en nuestra nota de julio de 2025. Los detalles siguientes proceden de ese registro y de guías de migración publicadas después del cierre.

¿Puedo recuperar mi clon de voz de PlayHT?

No. PlayHT eliminó las cuentas, el audio guardado y los clones de voz al cerrar, sin herramientas de exportación, y el dominio ya no resuelve. La única opción es volver a clonar la voz a partir de tus grabaciones originales. Diez segundos de audio de una sola persona bastan para empezar con un Instant Voice Clone, y con 30 minutos o más se entrena un Pro Voice Clone.

¿Puedo reutilizar un identificador de voz de PlayHT con Cartesia?

No. Los identificadores de voz son específicos de cada proveedor. Selecciona una voz de Cartesia o crea una personalizada con grabaciones que tengas permiso para usar. Después actualiza tus solicitudes.

¿Sonic admite varios idiomas?

Sí. Consulta los idiomas compatibles para conocer la cobertura actual y prueba las voces y los acentos regionales que necesitan tus usuarios.

¿Cómo puedo probar Cartesia?

Usa el entorno de pruebas con tu propio texto y consulta después la documentación de la API para integrarla. Revisa los precios para conocer los límites y las condiciones actuales de los planes.