本日、Sonic Multilingualの新たな8言語のアルファ版を公開しました。ヒンディー語、イタリア語、韓国語、オランダ語、ポーランド語、ロシア語、スウェーデン語、トルコ語が加わり、対応言語は合計15になりました。業界トップクラスの低レイテンシ、高く評価されている会話の品質、音声デザインなど、Sonicの英語版で利用できる機能を多言語版でも利用できます。
リアルタイムで高品質な音声生成を、より多くの人に届けるための節目です。
Sonicの対応範囲を広げる
Sonic MultilingualはSonic音声モデルの機能を広げ、開発者やユーザーが多様な言語や地域に向けて、自然な音声を使うアプリケーションをつくれるようにします。対応言語は次のとおりです。
- ドイツ語 (de) - Deutsch
- ポルトガル語 (pt) - Português
- 中国語 (zh) - 中文
- 日本語 (ja) - 日本語
- フランス語 (fr) - Français
- スペイン語 (es) - Español
- ヒンディー語 (hi) - हिन्दी
- イタリア語 (it) - Italiano
- 韓国語 (ko) - 한국어
- オランダ語 (nl) - Nederlands
- ポーランド語 (pl) - Polski
- ロシア語 (ru) - Русский
- スウェーデン語 (sv) - Svenska
- トルコ語 (tr) - Türkçe
使い方
Sonic Multilingualの動作は、こちらのライブデモで確認できます。複数の言語で、自然な音声を低レイテンシで生成する様子をご覧ください。
Sonic Multilingualは次の手順で利用できます。
- アプリケーションまたはAPIで「sonic-multilingual」モデルを選びます。
- 利用可能な14の選択肢から、使いたい言語を選びます。
- モデルに話してほしいテキストを入力します。
- 音声ライブラリから声を選びます。最良の結果を得るには、入力したテキストと同じ言語の声を選ぶことをおすすめします。
- 「Speak」ボタンを押し、低レイテンシで生成された自然な音声を聴きます。
- 保存する場合は、「Download」ボタンで音声をダウンロードします。
状態空間モデルを基盤に
Sonic Multilingualも、当社のほかのモデルと同じく状態空間モデル、SSMのアーキテクチャを採用しています。根本的に効率の高いこの手法によって、音声のような高解像度のモダリティをリアルタイムで処理・生成できます。当社のチームが開発したS4やMambaなどの状態空間モデルは、系列長に対する計算コストがほぼ線形に増えるため、低レイテンシで高品質な音声生成に適しています。
私たちと一緒に
Sonicを使ったリアルタイム会話AIの開発で協業をご検討の方は、ぜひご連絡ください。
- 試してみる: 登録して、新しい多言語機能を体験してください。優先サポート、個別のSLA、ボリュームディスカウントなどをご希望の場合は、法人向けフォームをご利用ください。
- チームに参加する: あらゆるデバイスにリアルタイムのマルチモーダル知能を届けることに関心がある方へ。幅広い職種で採用しています。
