Blog / Producto

Presentamos los siguientes 8 idiomas de Sonic Multilingual

Karan Goel 
Presentamos los siguientes 8 idiomas de Sonic Multilingual

Hoy anunciamos la versión alfa de nuestros siguientes 8 idiomas en Sonic Multilingual: hindi, italiano, coreano, neerlandés, polaco, ruso, sueco y turco. Con ellos, el número total de idiomas compatibles asciende a 15. Todas las funciones de Sonic English también están disponibles en la versión multilingüe, incluida una latencia líder en el sector, una calidad conversacional muy valorada y el diseño de voces.

Es un paso importante para que cualquier persona pueda acceder a nuestra generación de voz en tiempo real, líder en el sector.

Ampliamos las capacidades de Sonic

Sonic Multilingual amplía las capacidades de nuestro avanzado modelo de voz Sonic. Permite a desarrolladores y usuarios crear aplicaciones con voz natural para distintos idiomas y regiones. Los idiomas compatibles incluyen:

  • Alemán (de) - Deutsch
  • Portugués (pt) - Português
  • Chino (zh) - 中文
  • Japonés (ja) - 日本語
  • Francés (fr) - Français
  • Español (es) - Español
  • Hindi (hi) - हिन्दी
  • Italiano (it) - Italiano
  • Coreano (ko) - 한국어
  • Neerlandés (nl) - Nederlands
  • Polaco (pl) - Polski
  • Ruso (ru) - Русский
  • Sueco (sv) - Svenska
  • Turco (tr) - Türkçe

Cómo funciona

Mira esta demostración en directo para ver Sonic Multilingual en acción. En el vídeo comprobarás cómo nuestro modelo genera voz natural en varios idiomas con baja latencia.

Para empezar con Sonic Multilingual:

  1. Selecciona el modelo “sonic-multilingual” en tu aplicación o mediante nuestra API.
  2. Elige el idioma que prefieras entre las 14 opciones disponibles.
  3. Escribe el texto que quieres que diga el modelo.
  4. Elige una voz de nuestra variada biblioteca. Para obtener el mejor rendimiento, recomendamos usar voces que coincidan con el idioma del texto.
  5. Pulsa el botón “Speak” para generar voz natural con baja latencia.
  6. Si quieres guardar el audio, descárgalo con el botón “Download”.

Basado en modelos de espacio de estados

Como todos nuestros modelos, Sonic Multilingual se basa en nuestra arquitectura de modelos de espacio de estados, o SSM. Este enfoque, más eficiente en su diseño, permite procesar y generar modalidades de alta resolución, como el audio, en tiempo real. Los modelos de espacio de estados como S4 y Mamba, desarrollados originalmente por nuestro equipo, presentan costes que crecen de forma casi lineal con la longitud de la secuencia. Por ello resultan adecuados para generar voz de alta calidad y baja latencia.

Participa

Si te interesa colaborar con nosotros para crear IA conversacional en tiempo real con Sonic, queremos escucharte.

  • Pruébalo ahora: regístrate y descubre nuestras nuevas funciones multilingües. Rellena el formulario para empresas si necesitas soporte prioritario, SLA personalizados, descuentos por volumen y otras opciones.
  • Únete al equipo: si te apasiona llevar inteligencia multimodal en tiempo real a todos los dispositivos, estamos contratando en todas las áreas.