Blog / Prodotto

Presentiamo Voice Changer: trasforma l'audio come vuoi

Karan Goel 
Presentiamo Voice Changer: trasforma l'audio come vuoi

Oggi lanciamo Voice Changer, il nostro nuovo modello che trasforma la voce di qualsiasi clip audio mantenendone interpretazione ed emozione originali.

Scegli dalla nostra libreria di voci di qualità da studio oppure clona la tua, conservando il pieno controllo su sfumature come vocalizzazioni, emozione e prosodia.

Preservare il parlato naturale

Voice Changer mantiene le qualità che rendono il parlato unico, naturale e coinvolgente, proprio come nella clip originale.

Questa è una narrazione del capitolo 12 di Alice nel Paese delle Meraviglie, “Alice’s Evidence”, in cui abbiamo trasformato l’audio di ingresso in quattro voci del Playground: Child, Movie Guy, Reading Lady e Wizard.

Nota come ogni clip trasformata conserva l’espressività, le vocalizzazioni, come sospiri ed esclamazioni, e la prosodia del narratore originale. Questa coerenza permette transizioni vocali senza stacchi, anche quando abbiamo modificato la voce del narratore cinque volte nella stessa clip.

Abbiamo trasformato la clip originale

in tutte le clip qui sotto, ciascuna con una voce diversa.

Controllo preciso sull’interpretazione

Il nostro prodotto di sintesi vocale comprende il contesto, ma a volte serve un controllo preciso su come viene letto un testo. Voice Changer ti dà questo controllo, per perfezionare ogni aspetto dell’interpretazione, dall’emozione ai tempi.

Confronta questi esempi:

Casi d’uso

Puoi usare Voice Changer in molti modi:

  • Se crei contenuti, registra il parlato esattamente come vuoi e trasformalo nella voce che preferisci per creare contenuti unici ed espressivi.
  • Per videogiochi e intrattenimento, recita i dialoghi come desideri e usa per ciascuno la voce del personaggio che preferisci, con qualità da studio.
  • Se ascolti contenuti, trasforma audiolibri, lezioni e podcast per dare a ogni personaggio una voce diversa.
  • In azienda, permetti a qualsiasi dipendente di creare rapidamente audio realistico, espressivo e di qualità da studio, adatto al marchio e agli obiettivi.

Combinando la generazione vocale Sonic con Voice Changer, puoi generare qualsiasi parlato e modificarlo perché suoni come vuoi.

Hai in mente un nuovo caso d’uso? Condividilo con noi su X, già Twitter, @cartesia_ai, oppure invialo alla nostra raccolta di progetti degli sviluppatori.

Per iniziare

Voice Changer è disponibile nel Playground in tre passaggi:

  1. Registra la tua voce o carica un file.
  2. Scegli la voce di destinazione.
  3. Genera audio di alta qualità nella nuova voce.

Visita il portale sviluppatori per guide dettagliate all’implementazione e documentazione API.

Basato sui modelli a spazio di stato

Come tutti i nostri modelli, Voice Changer si basa sul nostro lavoro nelle architetture di modelli a spazio di stato, SSM. Questo approccio fondamentalmente diverso permette di elaborare e generare modalità ad alta risoluzione come l’audio con ottima qualità. Modelli come S4 e Mamba, sviluppati originariamente dal nostro team, hanno costi che crescono in modo quasi lineare con la lunghezza della sequenza e sono quindi adatti alla generazione vocale di alta qualità.

Partecipa

Vogliamo vedere come sviluppatori e creatori useranno Voice Changer per costruire nuove esperienze:

  • Provalo ora: registrati e scopri le capacità di Voice Changer.
  • Assistenza per le imprese: compila il modulo per soluzioni personalizzate, SLA e prezzi basati sui volumi.
  • Unisciti al team: stiamo assumendo in tutte le funzioni per far progredire l’IA.