Aujourd’hui, nous annonçons la version alpha de huit nouvelles langues dans Sonic Multilingual : hindi, italien, coréen, néerlandais, polonais, russe, suédois et turc. Le nombre total de langues prises en charge passe ainsi à 15. Toutes les fonctions que vous appréciez dans Sonic English sont aussi disponibles en multilingue : latence de premier plan, qualité conversationnelle très bien notée et conception de voix.
C’est une étape importante pour rendre notre génération vocale en temps réel, parmi les meilleures du secteur, accessible à tous.
Élargir les capacités de Sonic
Sonic Multilingual étend les capacités de notre modèle vocal de pointe Sonic. Les développeurs et les utilisateurs peuvent créer des applications à la voix réaliste dans un large éventail de langues et de régions. Les langues prises en charge comprennent :
- Allemand (de) - Deutsch
- Portugais (pt) - Português
- Chinois (zh) - 中文
- Japonais (ja) - 日本語
- Français (fr) - Français
- Espagnol (es) - Español
- Hindi (hi) - हिन्दी
- Italien (it) - Italiano
- Coréen (ko) - 한국어
- Néerlandais (nl) - Nederlands
- Polonais (pl) - Polski
- Russe (ru) - Русский
- Suédois (sv) - Svenska
- Turc (tr) - Türkçe
Comment cela fonctionne
Pour voir Sonic Multilingual en action, regardez cette démonstration en direct. La vidéo montre comment notre modèle génère une voix réaliste dans plusieurs langues avec une faible latence.
Pour commencer avec Sonic Multilingual :
- Sélectionnez le modèle “sonic-multilingual” dans votre application ou via notre API.
- Choisissez votre langue parmi les 14 options disponibles.
- Saisissez le texte que vous souhaitez faire prononcer au modèle.
- Choisissez une voix dans notre bibliothèque variée. Pour de meilleurs résultats, nous recommandons une voix correspondant à la langue de votre texte.
- Cliquez sur “Speak” pour découvrir une génération vocale réaliste à faible latence.
- Cliquez sur “Download” si vous souhaitez enregistrer l’audio.
Des modèles à espace d’états
Comme tous nos modèles, Sonic Multilingual repose sur notre architecture innovante de modèles à espace d’états, ou SSM. Cette approche fondamentalement plus efficace permet à nos modèles de traiter et de générer en temps réel des modalités haute résolution comme l’audio. Les modèles à espace d’états tels que S4 et Mamba, initialement développés par notre équipe, ont des coûts qui augmentent de façon presque linéaire avec la longueur des séquences. Ils conviennent donc particulièrement à la génération vocale de qualité à faible latence.
Rejoignez-nous
Si vous souhaitez collaborer avec nous pour créer une IA conversationnelle en temps réel avec Sonic, nous serions ravis d’échanger.
- Essayez maintenant : inscrivez-vous pour découvrir nos nouvelles capacités multilingues. Remplissez notre formulaire entreprise pour bénéficier d’un support prioritaire, de SLA personnalisés, de remises sur volume et d’autres services.
- Rejoignez notre équipe : si vous souhaitez apporter l’intelligence multimodale en temps réel à chaque appareil, nous recrutons dans toutes les fonctions.
