企業について
Dailyは音声と映像の分野を先導し、世界中の数千人の開発者にインフラとSDKを提供しています。業界をリードするグローバルなエッジネットワークは、75の拠点を通じ、50億人を超えるユーザーに13 ms未満の最初のホップの遅延を提供します。2016年以来の技術革新には、Rustの共通コアを基盤とする初のクロスプラットフォームWebRTC SDK、エンドツーエンドの適応型帯域管理を備えた超低遅延メッシュネットワーク、そして最近では、最も急速に成長する音声AIのオープンソースフレームワークPipecatの公開が含まれます。
DailyによるMetal Gearへのオマージュは、Sonicがゲーム内のリアルタイム会話を支える様子を示しています。音声はCartesia、オーケストレーションと超低遅延の転送はDaily Botsが担います。デモを試し、KwindlaのXへの投稿をご覧ください。
今年の初め、Dailyは音声AI向けのオープンソースクラウドDaily Botsを公開しました。開発者は、ウェブ、iOS、Android、Python、電話向けのオープンソースSDKと任意のLLMを使い、適応型の音声AIエージェントを構築できます。Dailyのインフラ上で大規模に運用することも可能です。初日には数百人の開発者が登録し、RTVIとPipecatのオープン標準を基盤とするホスト型エージェントへの潜在需要が表れました。
DailyはCartesiaとの協力により、優れた会話体験と企業向けの信頼性に向けて、適応型音声AIを最適化しています。
- 超低遅延:Daily Botsは、ネットワーク転送を含む音声から音声への遅延を、最速500msに抑えます。これは人間の会話の速度です。Cartesia Sonicの速さが、その実現を支えています。Cartesiaは、ネットワークのオーバーヘッドを含め、音声推論の最初のバイトが届くまでの時間を一貫して180 ms以下に抑えています。
- リアルな音声:Cartesia Sonicを活用することで、Dailyは13言語で自然かつ応答性の高い音声のやり取りを提供し、カスタム音声にも対応しています。
- 業界をリードする研究チーム:「Cartesiaのチームは、状態空間モデル(SSM)を使い、極めて効率的で高性能なリアルタイムモデルを構築する先駆者として高く評価されています。優れたAI研究者が集まり、リアルさ、プロンプトやカスタマイズ、実現できるとは思わなかった低遅延まで、音声AIの可能性を広げています」とHultman Kramerは語ります。
Cartesia Sonicは、リアルタイムのマルチモーダル用途において、現在最も優れた音声モデルです。Dailyでは、テキスト読み上げを使って開発するオープンソース開発者や法人顧客と幅広く協力してきました。Cartesiaの最先端の研究と、高品質、柔軟性、速い応答、適正なコストの組み合わせから生まれる革新を見るのは楽しみです。Daily Botsの開発者にとって、カスタマーサポート、予約調整、バーチャル人格とのやり取りなど、新たな音声AIの用途が開かれています。Cartesiaとの提携を心からうれしく思います。
Dailyは2016年からリアルタイムの音声・映像体験を先導し、次世代のAI体験を切り開く熱心な開発者コミュニティを築いてきました。急成長するオープンソースの音声フレームワークPipecatの開発元として、Sonicをリアルタイムのアプリケーション向けに最適化するうえで、重要なパートナーでした。Daily Botsは、音声アプリケーションを構築する開発者に、他にないワークフローの柔軟性を提供します。その主要な音声プロバイダーとして提携できることをうれしく思います。