PlayHTは2025年12月31日にサービスを完全に終了しました。Metaは2025年7月にPlayAIのチームを買収し、その月末までにAPIが停止しました。play.htのスタジオとVoice Agentsを含むプラットフォーム全体も年末に終了しています(当時の投稿)。現在はログインできるサービス自体がありません。PlayHTは終了時にアカウント、保存された音声、声のクローンを削除し、エクスポート用のツールも提供しませんでした。2026年にはplay.htドメインの名前解決もできなくなりました。詳細は終了後に公開された移行ガイドにまとめられています。
ここでいう代替サービスは、好きなときに移れる似たツールではありません。現在も提供されているサービスで、統合、音声ファイル、声を作り直す必要があります。
PlayHTからの移行で復元できるもの
統合。 エンドポイントは2025年7月下旬から停止しているため、PlayHTを呼び出すコードはすでに動きません。新しい提供元のAPIに置き換え、ストリーミング、エラー、再試行、接続の中断など、実際に使う処理をテストしてください。
音声。 PlayHTのサーバーに保存されていたファイルは、サービス終了時に削除されました。自分のストレージにダウンロードしたファイルは残っています。それ以外は台本から再生成してください。どの提供元を選ぶ場合も、今回は生成した音声を自分で管理できる場所に保存しましょう。
声。 声のクローンは削除され、エクスポートもできません。元の録音から再びクローンしてください。1人の話者の音声が10秒あればInstant Voice Cloneを始められます。30分以上あれば、アクセントや声の特徴をよりよく保つPro Voice Cloneを学習できます。今後も必要な声ごとに行ってください。録音ガイドでは、使用に適したクリップの条件を説明しています。
比較するポイント
PlayHTから移るなら、台本、声の個性、音声形式、API統合の動作など、保つ必要があるものから始めます。新しい声のカタログは、移行の一部にすぎません。
アプリならSonicのようなTTS APIを評価します。手作業で音声を制作するなら、エディターと出力の流れを比較します。新しく依存する前に、どのサービスも現在の提供状況とサポートを確認してください。 サービス終了後のこの確認は、単なる形式ではありません。変わったのは、まさにサービスを利用できるかどうかだからです。
以下は異なる用途の選択肢であり、性能順のランキングではありません。決定する前に、各社の現在の提供状況、機能、プランの条件を確認してください。
代替候補の一覧
| 製品 | 主な評価用途 | 選ぶ前の確認事項 |
|---|---|---|
| Cartesia | 音声アプリ向けの発話 | モデル、言語、統合の要件 |
| Murf AI | 台本付きナレーション | 編集操作と出力権利 |
| Speechify | 文書の読み上げ | 読み上げアプリ、スタジオ、APIのプラン |
| ElevenLabs | 音声生成と吹き替え | モデルの選択と利用上限 |
| Synthesia | AIプレゼンターの動画 | アバターの要件と動画の出力 |
| WellSaid Labs | 業務用ナレーション | チームの作業と対応言語 |
| Lovo AI | 収録ナレーションと会話 | 話し方の制御と修正の流れ |
| Descript | 文字起こしによるメディア編集 | 編集の流れと出力の選択肢 |
| Fliki | 台本から動画を制作 | 場面の編集とナレーションのタイミング |
| Amazon Polly | AWSアプリのTTS | 音声エンジン、地域、対応する制御 |
| Voicemaker | テキストから音声クリップ | 発話の制御とダウンロード上限 |
| Wavel AI | 吹き替えとローカライズ | 翻訳の確認とタイミング |
| Speechelo | 台本からナレーションを生成 | 購入条件とAPIの提供状況 |
| NaturalReader | 文書の読み上げ | ファイル対応と個人・商用の権利 |
| Uberduck | 合成ボーカル | 声の権利と許可される用途 |
Cartesia

私たちは、音声アプリケーション向けの音声合成モデルSonicを開発しています。生成音声のストリーミング、声の選択、使用許可のある録音からの声のクローンが可能です。APIを組み込む前に、Playgroundで自分のテキストを試してください。
完全な音声エージェントには、音声認識と会話の処理も必要です。Inkは音声認識モデル、Managed Agentsは音声エージェントの作成ツールです。Sonicだけでは発信者の声を聴いたり、話す内容を決めたりはしません。
使うモデルとプランの対応言語、APIの要件、料金を確認してください。応答時間は実際のアプリケーションで測りましょう。ユーザーが聴くまでの時間には、通信と再生のバッファーも影響します。
Murf AI

Murf AIには、台本を編集し、ナレーションをメディアに合わせる音声制作エディターがあります。研修資料や録画したプレゼンテーション向けに検討できます。台本に必要な編集量を試し、出力とチーム利用がプランに含まれるか確認してください。
Speechify

Speechifyには、文書やウェブページを音声にする読み上げアプリがあります。既存のテキストを聴くことが目的なら、その流れから試しましょう。読み上げ、スタジオ、APIは別々に評価してください。一つを使えても、他の機能が含まれるとは限りません。
ElevenLabs

ElevenLabsには、音声合成、声のクローン、吹き替え、会話型アプリ向けの製品があります。実際に導入するモデルとエンドポイントを比較しましょう。モデルを交換可能なものと考えず、自分の台本で発音と応答時間を試してください。
Synthesia

Synthesiaは、AIのプレゼンターとナレーション付きの動画を作成します。画面に話者を映す完成品が必要な場合に検討できます。音声だけなら、使わない動画機能に費用を払わずに済む音声APIを確認しましょう。
WellSaid Labs

WellSaid Labsは、研修や社内広報などの業務用ナレーション制作に重点を置いています。チームの台本レビューと発音修正の方法を評価し、利用するプランの対応言語とAPIへのアクセスを確認してください。
Lovo AI

Lovo AIは、音声生成と録音コンテンツの制作ツールを組み合わせています。話し方を変える必要がある会話やナレーションで試しましょう。台本全体を聴き、修正と商用の出力がプランにどう含まれるかを確認します。
Descript

Descriptは、文字起こしとテキストによる音声・動画編集を組み合わせています。テキストを編集して録音素材を切りたい場合に検討できます。音声APIだけではこのエディターを置き換えられないため、移行前に録音から出力までの流れを試してください。
Fliki

Flikiは、台本をナレーション付き動画に変換します。映像と声を一つのエディターで組み立てたい場合に検討できます。プランを選ぶ前に、場面、タイミング、発音の修正に必要な手作業を確認してください。
Amazon Polly

Amazon PollyはAWSの音声合成サービスです。すでにAWSの認証や課金を使うアプリなら候補になります。音声エンジンごとに対応言語と制御が異なるため、サービス全体の機能一覧でなく、導入するエンジンを確認してください。
Voicemaker

Voicemakerは、声と話し方を制御できる音声合成インターフェースです。短い台本で、発音やペースの調整に必要な制御があるか試してください。選ぶプランのダウンロード形式、利用上限、商用権利も確認します。
Wavel AI

Wavel AIには、吹き替えとナレーションのツールがあります。ローカライズでは翻訳と音声を別々に評価してください。流暢な録音にも誤訳はありえます。字幕のタイミングと母語話者の確認も評価に含めましょう。
Speechelo

Speecheloは、テキストからナレーションを生成するツールです。購入に含まれる現在の内容、特に利用上限と商用権利を確認してください。アプリ内で音声を生成するなら、エディターに付属すると思い込まず、APIへのアクセスを確認します。
NaturalReader

NaturalReaderには、文書を聴く機能と音声生成のツールがあります。個人の読書と商用音声の制作を分けてプランを比較してください。実際に使う形式で試しましょう。スキャンしたPDFは、音声合成の前に文字認識も必要です。
Uberduck

Uberduckは、合成ボーカルと娯楽用途に重点を置いています。そのような出力が必要なプロジェクトで評価してください。声と録音それぞれの権利を確認しましょう。カタログに声があることは、その話者になりすます許可を意味しません。
切り替える前に試す
代表的な入力テキストと現在のモデル設定を保存します。声のIDは提供元ごとに違うため、必要な権利を持つ代わりの声を選ぶか作る計画を立てます。実際のサンプルレートで出力を比較し、切り替え前にエラー、再試行、中断したストリームを試します。 生成したものはすべてコピーを保管してください。
想定する使用量と必要な機能で費用を比べてください。再試行、音声の再生成、同時実行の上限、商用権利も含めます。低い最低料金だけでは、実際の処理の費用は見積もれません。
