ブログ / 製品

Sonic Multilingualに新たな8言語を追加

Karan Goel 
Sonic Multilingualに新たな8言語を追加

本日、Sonic Multilingualの新たな8言語のアルファ版を公開しました。ヒンディー語、イタリア語、韓国語、オランダ語、ポーランド語、ロシア語、スウェーデン語、トルコ語が加わり、対応言語は合計15になりました。業界トップクラスの低レイテンシ、高く評価されている会話の品質、音声デザインなど、Sonicの英語版で利用できる機能を多言語版でも利用できます。

リアルタイムで高品質な音声生成を、より多くの人に届けるための節目です。

Sonicの対応範囲を広げる

Sonic MultilingualはSonic音声モデルの機能を広げ、開発者やユーザーが多様な言語や地域に向けて、自然な音声を使うアプリケーションをつくれるようにします。対応言語は次のとおりです。

  • ドイツ語 (de) - Deutsch
  • ポルトガル語 (pt) - Português
  • 中国語 (zh) - 中文
  • 日本語 (ja) - 日本語
  • フランス語 (fr) - Français
  • スペイン語 (es) - Español
  • ヒンディー語 (hi) - हिन्दी
  • イタリア語 (it) - Italiano
  • 韓国語 (ko) - 한국어
  • オランダ語 (nl) - Nederlands
  • ポーランド語 (pl) - Polski
  • ロシア語 (ru) - Русский
  • スウェーデン語 (sv) - Svenska
  • トルコ語 (tr) - Türkçe

使い方

Sonic Multilingualの動作は、こちらのライブデモで確認できます。複数の言語で、自然な音声を低レイテンシで生成する様子をご覧ください。

Sonic Multilingualは次の手順で利用できます。

  1. アプリケーションまたはAPIで「sonic-multilingual」モデルを選びます。
  2. 利用可能な14の選択肢から、使いたい言語を選びます。
  3. モデルに話してほしいテキストを入力します。
  4. 音声ライブラリから声を選びます。最良の結果を得るには、入力したテキストと同じ言語の声を選ぶことをおすすめします。
  5. 「Speak」ボタンを押し、低レイテンシで生成された自然な音声を聴きます。
  6. 保存する場合は、「Download」ボタンで音声をダウンロードします。

状態空間モデルを基盤に

Sonic Multilingualも、当社のほかのモデルと同じく状態空間モデル、SSMのアーキテクチャを採用しています。根本的に効率の高いこの手法によって、音声のような高解像度のモダリティをリアルタイムで処理・生成できます。当社のチームが開発したS4やMambaなどの状態空間モデルは、系列長に対する計算コストがほぼ線形に増えるため、低レイテンシで高品質な音声生成に適しています。

私たちと一緒に

Sonicを使ったリアルタイム会話AIの開発で協業をご検討の方は、ぜひご連絡ください。

  • 試してみる: 登録して、新しい多言語機能を体験してください。優先サポート、個別のSLA、ボリュームディスカウントなどをご希望の場合は、法人向けフォームをご利用ください。
  • チームに参加する: あらゆるデバイスにリアルタイムのマルチモーダル知能を届けることに関心がある方へ。幅広い職種で採用しています。