
CartesiaとAmazon Pollyの比較
リスナーはCartesiaのSonic 3.6をすべてのAmazon Pollyエンジンより高く評価しています。
ServiceNow、Decagon、Quoraは本番環境の音声エージェントにCartesiaを使用しています。1つのモデルで44言語、最初の音声まで90ms未満。


音声品質
リスナーはSonic 3.6をすべてのPollyエンジンより高く評価
- Artificial Analysisはモデル名を伏せて同じ文のクリップを2つ再生し、 掲載するすべてのモデルを同じ方法で評価します。
- Sonic 3.6は、Pollyで最も評価の高いPolly Generativeを200ポイント以上上回っています。
Provider Voice ArenaのEloスコア
高いほど良い
速度
Sonic 3.6の生成速度はPollyで最も評価の高い2つのエンジンを上回ります
- Artificial Analysisは掲載するすべてのモデルを同じ測定環境で計測し、 1秒あたりの生成文字数を比較します。
- Sonic 3.6はPolly GenerativeとPolly Long-formより高速です。つまり、リスナーが好む声は 生成も速いのです。
1秒あたりの文字数
高いほど良い
企業がAmazon PollyではなくCartesiaを選ぶ理由
Generative, Long-form, Neural, Standard人間らしい自然さ
完了率の向上につながる抑揚、テンポ、発音、感情表現、音質
Cartesia1276 EloAmazon Polly1064 EloPolly Generative1032 EloPolly Long-form892 EloPolly Neural829 EloPolly Standard2026年9月
言語一覧
世界の顧客に伝わり、信頼につながるか。
Cartesia1つのモデルで44言語とネイティブなアクセントに対応Amazon Polly9言語の生成音声独自の声
必要な音声の量と、利用できる対象者。
Cartesia公開APIで10秒からのインスタントクローン、30分からのプロフェッショナルクローンAmazon PollyAmazon Pollyチームとの個別契約によるBrand Voice導入形態
規制のある組織でも利用できるか。
Cartesia政府機関、医療機関、金融機関でオンプレミスとエアギャップ環境の稼働実績があり、稼働率99.9%のSLAを提供Amazon Polly10のAWSリージョンで生成音声を提供会話処理全体の構成
1回の通話に必要な製品の数。
Cartesia1社の1つのAPIでTTS、STT、Agentsを提供Amazon Polly音声生成にはPolly、文字起こしとエージェントには別のAWSサービスが必要
よくある質問
AWS PollyとAmazon Pollyは同じですか?
はい。Amazon PollyはAWSのテキスト読み上げサービスで、どちらの名前でも検索されています。このページではSonic 3.6を、Pollyの4つのエンジン、Generative、Long-form、Neural、Standardと比較します。
品質スコアはどう測定されていますか?
独立したベンチマークであるArtificial Analysisの結果です。リスナーはモデル名を知らされずに同じ文の2つのクリップを聴き、好みの方を選びます。Sonic 3.6は、Pollyの4つのエンジン、Generative、Long-form、Neural、Standardすべてを上回る評価です。
Cartesiaは何言語に対応していますか?
1つのモデルで英語、スペイン語、フランス語、ドイツ語、日本語など44言語に対応しています。英語モデルに後付けするのではなく、地域ごとにアクセントを調整しています。Pollyの生成音声は9言語に対応しています。
Cartesiaで自分の声を使えますか?
はい。インスタントクローンには10秒、プロフェッショナルクローンには30分の音声が必要です。どちらも公開APIからセルフサービスで利用できます。Amazon Pollyのカスタム音声Brand Voiceは、Pollyチームとの個別契約で制作されます。
自社のインフラでCartesiaを実行できますか?
はい。Cartesiaはオンプレミスとエアギャップ環境にデプロイできます。医療、金融、政府機関のチームが音声を自社ネットワーク内に保つために利用しており、稼働率99.9%のSLAが適用されます。
Amazon Pollyからの移行にはどれくらいかかりますか?
多くのチームで1〜2週間です。Cartesiaは主要な音声エージェントプラットフォームと統合され、すべてのモデルを公開APIで利用できます。別のプラットフォームに移る必要も、後から依存関係を解く手間もありません。
今すぐ始める
専門家に相談する。
音声体験の開発にCartesiaをどう活用できるか、私たちのチームにご相談ください。
開発を始める。
APIでモデルにアクセスし、数分で音声エージェントを本番環境に導入できます。