Oggi annunciamo la versione alfa di altre 8 lingue su Sonic Multilingual: hindi, italiano, coreano, olandese, polacco, russo, svedese e turco. Il numero totale di lingue supportate sale così a 15. Tutte le funzionalità che apprezzi in Sonic English funzionano anche nella versione multilingue, dalla latenza ai vertici del settore alla qualità conversazionale e alla progettazione delle voci.
È un passo importante per rendere accessibile a tutti la nostra generazione vocale in tempo reale, ai vertici del settore.
Le nuove capacità di Sonic
Sonic Multilingual amplia le capacità del nostro modello vocale Sonic, consentendo a sviluppatori e utenti di creare applicazioni con parlato realistico per lingue e regioni diverse. Le lingue supportate includono:
- Tedesco (de) - Deutsch
- Portoghese (pt) - Português
- Cinese (zh) - 中文
- Giapponese (ja) - 日本語
- Francese (fr) - Français
- Spagnolo (es) - Español
- Hindi (hi) - हिन्दी
- Italiano (it) - Italiano
- Coreano (ko) - 한국어
- Olandese (nl) - Nederlands
- Polacco (pl) - Polski
- Russo (ru) - Русский
- Svedese (sv) - Svenska
- Turco (tr) - Türkçe
Come funziona
Per vedere Sonic Multilingual in azione, guarda questa dimostrazione dal vivo. Nel video puoi sentire come il modello genera parlato realistico in più lingue con bassa latenza.
Iniziare con Sonic Multilingual è semplice:
- Seleziona il modello “sonic-multilingual” nella tua applicazione o tramite la nostra API.
- Scegli la lingua preferita tra le 14 opzioni disponibili.
- Scrivi il testo che vuoi far pronunciare al modello.
- Scegli una voce dalla nostra ampia libreria. Per ottenere i risultati migliori, consigliamo voci che corrispondano alla lingua del testo.
- Premi “Speak” per ascoltare la generazione vocale realistica a bassa latenza.
- Se vuoi salvare l’audio, scaricalo facendo clic su “Download”.
Basato sui modelli a spazio di stato
Come tutti i nostri modelli, Sonic Multilingual si basa sulla nostra architettura di modelli a spazio di stato, SSM. Questo approccio, fondamentalmente più efficiente, permette di elaborare e generare modalità ad alta risoluzione come l’audio in tempo reale. Modelli a spazio di stato come S4 e Mamba, sviluppati originariamente dal nostro team, hanno costi che crescono in modo quasi lineare con la lunghezza della sequenza. Questo li rende adatti alla generazione vocale di alta qualità e bassa latenza.
Partecipa
Se vuoi collaborare con noi per costruire IA conversazionale in tempo reale con Sonic, ci piacerebbe sentirti.
- Provalo ora: registrati e scopri le nuove capacità multilingue. Compila il modulo per le imprese per ricevere assistenza prioritaria, SLA personalizzati, sconti sui volumi e altro.
- Unisciti al team: se vuoi portare l’intelligenza multimodale in tempo reale su ogni dispositivo, stiamo assumendo in tutte le funzioni.
