Converti il testo in parlato come file MP3

Trasforma il testo in parlato naturale con Sonic. Scegli una voce, ascolta il tuo testo e scarica un MP3 per riproduzione nell'app, messaggi telefonici o narrazione.
104/500
Liv

Inserisci il testo, scegli una voce e crea il tuo MP3.

Il tuo copione, pronto da ascoltare

Verifica la voce con un breve brano, poi genera un file per il tuo player. Conserva il copione originale per poter rivedere la registrazione in seguito.

01

Prepara il copione

Scrivi il testo che vuoi nel file. Espandi le abbreviazioni poco note e controlla nomi, date e numeri prima di generare una registrazione finale.

02

Ascolta un'anteprima

Prova il testo nell'anteprima e confronta le voci. Ascolta l'interpretazione prima di creare il file MP3.

03

Salva l'MP3

Seleziona Crea MP3 e scarica il file audio. Ascoltalo di nuovo nel player che userà il tuo pubblico.

Genera un MP3 tramite l'API

Invia il tuo testo a Sonic, poi salva la risposta come MP3 per narrazioni, lezioni o riproduzione nella tua app.

Configura la richiesta

Scegli l'output MP3 e includi testo, voce e modello in una richiesta all'API Bytes. Invia la richiesta dal backend per mantenere privata la tua chiave API.

Salva la risposta audio

Verifica che la richiesta sia riuscita prima di salvare i byte della risposta in un file MP3. Gestisci prima eventuali errori dell'API, poi riproduci l'audio salvato per controllare il risultato.

Impostazioni dell'output MP3
output_format = {
    "container": "mp3",
    "sample_rate": 44100,
    "bit_rate": 128000,
}

Formato
MP3
Frequenza di campionamento
44.1 kHz
Bitrate
128 kbps

Scegli un formato per la destinazione finale

Parti dai formati accettati dal player. Un'integrazione telefonica e un file di narrazione scaricabile possono richiedere impostazioni diverse.

MP3

Per riproduzione e condivisione

Audio compresso per narrazione, messaggi delle app e player che accettano MP3. Scegli bitrate e frequenza di campionamento nella richiesta.

WAV

Per un flusso di montaggio

Un contenitore di file per audio PCM. Utile quando l'editor o il flusso di pubblicazione richiede WAV invece di MP3 compresso.

Audio grezzo

Per un'integrazione

Campioni audio senza intestazione del file. Allinea codifica e frequenza di campionamento al player o al sistema telefonico.

Metti il file al lavoro

Messaggi telefonici fissi

Genera saluti e messaggi di chiusura da testi approvati. Verifica che il sistema telefonico accetti MP3 prima di caricarli; alcuni sistemi richiedono invece WAV o audio grezzo.

Audio nell'app

Salva istruzioni vocali o brevi messaggi da riprodurre nella tua applicazione. Conserva il testo originale insieme a ogni file per sapere quale versione sentiranno gli utenti.

Valutazione delle voci

Confronta le voci usando le stesse frasi di prova. Rivedi pronuncia e ritmo prima di scegliere una voce per un agente rivolto ai clienti.

Domande frequenti su testo in MP3

Come imposto il formato di output dell'API su MP3?

Usa l'endpoint Text-to-Speech Bytes. Imposta output_format su {"container":"mp3","sample_rate":44100,"bit_rate":128000}. Includi gli altri campi richiesti e l'autenticazione indicati nel riferimento. Questo seleziona un MP3 a 44,1 kHz e 128 kbps; è una configurazione supportata, non un requisito per ogni applicazione. La risposta contiene byte audio, non un URL di download JSON.

Posso scaricare il risultato come file MP3?

Sì. Inserisci il testo nello strumento qui sopra, scegli una voce e seleziona Crea MP3. Quando il file è pronto, seleziona Scarica MP3. Per un'applicazione, richiedi MP3 all'API Bytes e salva la risposta riuscita come file .mp3.

La sintesi vocale MP3 è gratuita?

Puoi ascoltare in anteprima e scaricare brevi campioni MP3 in questa pagina senza un account. La generazione tramite API usa i crediti dell'account. Consulta i piani attuali di Cartesia per crediti inclusi, utilizzo aggiuntivo e condizioni di uso commerciale.

Dovrei usare MP3 o PCM per un agente vocale in tempo reale?

Usa il formato previsto dall'integrazione ricevente. MP3 comprime l'audio per la riproduzione di file; PCM rappresenta i campioni audio senza compressione MP3. Una chiamata in diretta può richiedere una codifica grezza e una frequenza di campionamento specifiche anziché MP3. Consulta la guida all'integrazione audio prima di scegliere le impostazioni di output. Un download veloce del file non misura la latenza della conversazione da un'estremità all'altra.

Quali lingue e controlli vocali posso usare?

Consulta la documentazione attuale del modello Sonic per la copertura linguistica. I modelli supportati hanno controlli di volume, velocità ed emozione. Testa la voce scelta in ogni lingua di destinazione. Ascolta nomi, abbreviazioni e numeri; la generazione vocale richiede comunque una revisione per il tuo caso d'uso.

Posso usare il parlato generato per un saluto IVR?

Sì, se il sistema telefonico accetta il formato del file e hai i diritti necessari sulla voce e sul testo. Genera saluti fissi da testi approvati e testali tramite una connessione telefonica. Un saluto preregistrato non interpreta la risposta del chiamante. Per chiamate interattive, esplora Cartesia Managed Agents.

L'anteprima in questa pagina scarica un MP3?

Sì. Crea MP3 genera un file dal testo, dalla voce e dalla lingua selezionati. Scarica MP3 appare al termine della generazione. Modificare il testo o cambiare voce cancella il download precedente, così puoi creare un nuovo file con la selezione aggiornata.

Qual è la differenza tra frequenza di campionamento e bitrate MP3?

La frequenza di campionamento descrive quante volte viene campionato l'audio ogni secondo. Il bitrate descrive quanti dati audio compressi vengono memorizzati al secondo. Scegli impostazioni supportate adatte al lettore. L'esempio in questa pagina usa 44100 campioni al secondo e 128000 bit al secondo; queste impostazioni non sono obbligatorie per ogni progetto.

Posso trasformare un documento o un PDF in un MP3?

Copia il testo che vuoi venga letto e rivedilo prima di generare audio. Rimuovi numeri di pagina, intestazioni ripetute e altro materiale che non deve essere letto ad alta voce. L'API vocale accetta testo; in questa pagina non estrae il testo da un PDF caricato.

Perché il mio MP3 salvato non viene riprodotto?

Verifica prima che la richiesta API sia riuscita e che tu abbia salvato la risposta come audio binario. Conferma di aver richiesto un contenitore MP3 e che il lettore supporti le impostazioni scelte. Rinominare un file WAV con estensione .mp3 non converte il formato audio.

Come dovrei preparare un testo lungo per una narrazione MP3?

Parti da un breve estratto per scegliere la voce e controllare la pronuncia. Organizza un testo più lungo in sezioni che puoi rivedere individualmente e mantieni la stessa voce e le stesse impostazioni di output. Ascolta ogni punto di unione prima di assemblare la narrazione finale nell'editor. Conserva una copia del testo originale, così una correzione successiva non richiede di riscriverlo tutto.

Continua a lavorare con la tua voce

Confronta voci per il prossimo copione o scopri come generare parlato dalla tua applicazione.

Trova una voce per il tuo copione

Confronta le voci su un breve brano prima di produrre il file finale. Usa il generatore vocale per sentire come ogni voce interpreta le tue parole.

Prova il generatore vocale

Genera audio con Python

Configura l'SDK Python ed esegui la tua prima richiesta di sintesi vocale. Parti dall'esempio completo e scegli il formato di output richiesto dal progetto.

Sviluppa con Python

Inizia oggi

Parla con un esperto.

Contatta un membro del nostro team e scopri come Cartesia può aiutarti a creare esperienze vocali di altissimo livello.

Contatta il team commerciale

Inizia a sviluppare.

Accedi ai nostri modelli tramite API e porta un agente vocale in produzione in pochi minuti.

Prova Cartesia