Cartesiaは、企業向け音声AIの進歩に取り組んでいます。その一環として、ServiceNowが発表したAI Experienceの一部である、新しいServiceNow AI Voice Agentsに、Cartesiaの最先端の音声AI技術を統合します。
最高水準の音声エージェントを構築するには、音声の理解と生成のための最先端AI音声モデルが必要です。Cartesiaは、状態空間モデル(SSM)という新しいAIアーキテクチャに関する、スタンフォード大学での長年の研究を基盤としています。状態空間モデルはTransformerに代わる方式で、長い文脈の推論と生成を大幅に効率化し、リアルタイムの制約下でも高品質な音声モデルを実現します。Cartesiaのテキスト読み上げモデルSonicは、90msの遅延で、最高水準の自然さと原稿への忠実さを提供します。Ink-Whisperは、高速なストリーミング音声認識モデルで、リアルタイムの文字起こしに最適化されています。
ビジネス変革のためのAIプラットフォームであるServiceNowは、人、データ、ワークフローを一つにつなぐ、プラットフォームにネイティブな、マルチモーダルかつ多言語対応のインターフェースAI Experienceを発表しました。AI Experienceでは、ビジネスのあらゆる領域と深くつながる音声、テキスト、画像、ウェブ、構築用のエージェントに即座にアクセスできます。文脈を踏まえ、個々の利用者に合わせ、先回りして対応するやり取りを実現します。AI Control Towerにより、企業はセキュリティと管理を維持しながら、安心してAI Experienceを迅速に導入できます。
Cartesiaの音声エージェントのオーケストレーションは、AI Experienceとともに提供されるServiceNow AI Voice Agentsに統合されます。テキストベースのエージェントワークフローを音声に展開したい技術チーム向けの仕組みです。
ServiceNowの顧客が求める企業向けのセキュリティとコンプライアンスの基準に合わせ、Cartesiaは、完全にエアギャップで隔離したオンプレミス環境に、AI音声モデル、推論エンジン、オーケストレーションを提供します。また、Cartesiaのエージェントオーケストレーションと推論エンジンは、大量のリクエストに拡張し、高い稼働率で企業のワークロードに対応できます。さらに、SOC-2 Type 2、HIPAA、GDPR、PCIなどの高い企業向けコンプライアンス基準を満たしています。
ServiceNowは、人々とAIの働き方を変えることに取り組んでおり、音声はその未来の重要な一部です。Cartesiaの状態空間モデルは、企業向けの速度と品質を当社のAI Voice Agentsにもたらします。ServiceNow AI Platformの性能、セキュリティ、速度をCartesiaと組み合わせることで、企業はリアルタイムに理解し、行動し、適応する、安全で拡張性のある音声エージェントを導入できるようになります。