Aujourd’hui, nous lançons Voice Changer, notre nouveau modèle qui transforme la voix de n’importe quel clip audio tout en conservant son interprétation et son émotion d’origine.
Choisissez dans notre bibliothèque variée de voix de qualité studio ou clonez la vôtre, tout en gardant un contrôle total sur les nuances de vocalisation, d’émotion et de prosodie.
Préserver une parole naturelle
Voice Changer préserve les qualités qui rendent une voix unique, naturelle et captivante, telles qu’elles étaient dans le clip original.
Voici une narration du chapitre 12 d’Alice au pays des merveilles, “Alice’s Evidence”, dont nous avons transformé la voix en quatre voix différentes de notre playground : Child, Movie Guy, Reading Lady et Wizard.
Remarquez comment chaque clip transformé conserve l’expressivité, les vocalisations, comme les soupirs et les exclamations, et la prosodie du narrateur original. Cette cohérence rend les transitions vocales fluides, même lorsque nous avons fait changer la voix du narrateur cinq fois dans un seul clip.
Nous avons pu transformer le clip original
…en tous les clips ci-dessous, chacun avec une voix différente.
Un contrôle précis de l’interprétation
Même si notre produit de synthèse vocale tient compte du contexte, vous pouvez avoir besoin d’un contrôle précis sur la lecture d’un texte. Voice Changer vous donne ce contrôle pour ajuster chaque aspect de l’interprétation, de l’émotion au rythme.
Comparez ces exemples :
Cas d’usage
Vous pouvez utiliser Voice Changer de nombreuses façons :
- Pour les créateurs, enregistrez la parole exactement comme vous le souhaitez, puis remplacez-la par la voix de votre choix pour créer un contenu unique et expressif.
- Pour le jeu vidéo et le divertissement, jouez les dialogues comme vous l’entendez et utilisez pour chacun la voix de personnage souhaitée, avec une qualité studio.
- Pour les auditeurs, transformez vos livres audio, cours et podcasts préférés pour donner vie à chaque personnage avec une voix différente.
- Pour les entreprises, permettez à chaque collaborateur de créer rapidement un audio expressif et réaliste de qualité studio, adapté à votre marque et à vos objectifs.
En combinant la génération vocale de Sonic avec Voice Changer, vous pouvez générer n’importe quel discours puis le modifier pour obtenir exactement le rendu souhaité.
Vous avez un cas d’usage original en tête ? Partagez-le avec nous sur X, anciennement Twitter, à @cartesia_ai, ou proposez-le à notre vitrine de projets de développeurs.
Pour commencer
Voice Changer est disponible dans notre playground en trois étapes simples :
- Enregistrez-vous ou importez un fichier.
- Choisissez la voix de remplacement.
- Générez un audio de qualité avec la nouvelle voix.
Consultez notre portail développeur pour des guides de mise en œuvre détaillés et la documentation de l’API.
Des modèles à espace d’états
Comme tous nos modèles, Voice Changer repose sur nos travaux pionniers sur les architectures de modèles à espace d’états, ou SSM. Cette approche fondamentalement différente permet à nos modèles de traiter et de générer des modalités haute résolution comme l’audio avec une excellente qualité. Les modèles à espace d’états tels que S4 et Mamba, initialement développés par notre équipe, ont des coûts qui augmentent de façon presque linéaire avec la longueur des séquences. Ils conviennent donc particulièrement à la génération vocale de qualité.
Rejoignez-nous
Nous avons hâte de voir comment les développeurs et les créateurs utiliseront Voice Changer pour construire de nouvelles expériences :
- Essayez maintenant : inscrivez-vous pour découvrir les capacités de Voice Changer.
- Support entreprise : remplissez ce formulaire pour des solutions personnalisées, des SLA et des tarifs au volume.
- Rejoignez notre équipe : nous recrutons dans toutes les fonctions pour faire progresser l’innovation en IA.
