Hoje lançamos o Voice Changer, nosso novo modelo que transforma a voz de qualquer trecho de áudio e mantém a interpretação e a emoção originais.
Escolha uma voz da nossa biblioteca diversificada com qualidade de estúdio ou clone a sua, mantendo controle completo sobre nuances como vocalização, emoção e prosódia.
Preservação da fala natural
O Voice Changer preserva as qualidades que tornam a fala única, natural e envolvente, exatamente como no áudio original.
Nesta narração do capítulo 12 de Alice no País das Maravilhas, “O depoimento de Alice”, transformamos a entrada em quatro vozes do nosso playground: Child, Movie Guy, Reading Lady e Wizard.
Observe como cada trecho transformado mantém a expressividade, as vocalizações, como suspiros e exclamações, e a prosódia do narrador original. Essa consistência torna as transições de voz naturais, mesmo quando editamos a voz do narrador para mudar cinco vezes em um único trecho.
Conseguimos transformar o trecho original
em todos os trechos abaixo, cada um com uma voz diferente.
Controle preciso da interpretação
Embora nosso produto de texto para fala compreenda o contexto, às vezes você precisa controlar exatamente como um roteiro é lido. O Voice Changer oferece esse controle, permitindo aperfeiçoar cada aspecto da interpretação, da emoção ao ritmo.
Compare estes exemplos:
Casos de uso
Há muitas formas de usar o Voice Changer:
- Para criadores, grave a fala exatamente como deseja e troque para a voz de sua escolha para criar conteúdo único e emotivo.
- Para jogos e entretenimento, interprete os diálogos como quiser e use a voz de personagem de sua preferência em cada um, criando a experiência desejada com qualidade de estúdio.
- Para ouvintes, transforme seus audiolivros, aulas e podcasts favoritos para dar vida a cada personagem com uma voz diferente.
- Para empresas, permita que qualquer funcionário crie rapidamente áudio expressivo, realista e com qualidade de estúdio, adequado à sua marca e aos seus objetivos.
Combinando a geração de voz do Sonic com o Voice Changer, você pode gerar qualquer fala e modificá-la para que soe exatamente como deseja.
Tem um caso de uso inovador em mente? Compartilhe conosco no X, antigo Twitter, em @cartesia_ai, ou envie para nossa galeria de projetos de desenvolvedores.
Primeiros passos
O Voice Changer está disponível no nosso playground em três passos simples:
- Grave sua voz ou envie um arquivo
- Escolha a voz desejada
- Gere áudio de alta qualidade com a nova voz
Visite nosso portal de desenvolvedores para consultar guias detalhados de implementação e a documentação da API.
Baseado em modelos de espaço de estados
Como todos os nossos modelos, o Voice Changer se baseia no nosso trabalho pioneiro em arquiteturas de modelos de espaço de estados, ou SSMs. Essa abordagem fundamentalmente diferente permite processar e gerar modalidades de alta resolução, como áudio, com excelente qualidade. Modelos de espaço de estados como S4 e Mamba, originalmente desenvolvidos por nossa equipe, têm custos que crescem de forma quase linear com o comprimento da sequência, tornando-os ideais para gerar voz de alta qualidade.
Faça parte dessa jornada
Queremos ver como desenvolvedores e criadores usarão o Voice Changer para construir novas experiências:
- Experimente agora: cadastre-se e conheça os recursos do Voice Changer
- Suporte empresarial: preencha este formulário para soluções personalizadas, SLAs e preços por volume
- Entre para a equipe: estamos contratando em todas as áreas para avançar a inovação em IA
