CartesiaとSmallest AIの比較

リスナーはCartesiaのSonic 3.6をすべてのSmallest AIモデルより高く評価しています。

ServiceNow、Decagon、Quoraは本番環境の音声エージェントにCartesiaを使用しています。1つのモデルで44言語、公開APIで音声クローンを利用できます。

2X Solutions logo
arini logo
toby logo

音声品質

リスナーはSonic 3.6をすべてのSmallest AIモデルより高く評価

  • Artificial Analysisはモデル名を伏せて同じ文のクリップを2つ再生し、 掲載するすべてのモデルを同じ方法で評価します。
  • Sonic 3.6は、Smallest AIで最も評価の高いLightning v3.1 Proを100ポイント以上上回っています。

Provider Voice ArenaのEloスコア

高いほど良い

Artificial Analysis2026年9月
1276
1171
1022
Sonic 3.6
Cartesia
Lightning v3.1 Pro
Smallest AI
Lightning v3.1
Smallest AI

遅延

すべての四分位点でSonic 3.6が高速

  • Covalは各社の公開APIを呼び出し、すべてのリクエストで最初の音声までの時間を測定します。
  • 最速から最遅まで、Lightning v3.1 Proの分布のすべての四分位点がSonic 3.6を上回っています。 平均値にしか現れない差ではありません。

レイテンシーのばらつき:TTFA値の分布

低いほど良い

Coval2026年9月
0ms100ms200ms300ms400ms500ms600ms
Sonic 3.6
Cartesia
Lightning v3.1 Pro
Smallest AI
遅延の測定値を見る

最初の音声までの時間をミリ秒で表示しています。箱はリクエストの中央50%、線は中央値を示します。ひげは絶対的な最小値・最大値ではありません。

  • Sonic 3.6:中央値 307ms、中央50% 277〜352ms、ひげ 206〜463ms。
  • Lightning v3.1 Pro:中央値 334ms、中央50% 301〜399ms、ひげ 240〜546ms。

遅いリクエストの遅延

遅い応答でもSonic 3.6の方が高速

  • Covalは各社の公開APIを呼び出し、各リクエストが最初の音声を返すまでの 時間を記録します。
  • P95ではSonic 3.6が398msで最初の音声を返すのに対し、Lightning v3.1 Proは697msです。

P95のレイテンシー

低いほど良い

Coval2026年9月
398ms
697ms
Sonic 3.6
Cartesia
Lightning v3.1 Pro
Smallest AI

認識精度

Lightning v3.1 ProよりSonic 3.6は単語の誤りが少ない

  • Covalは各モデルが生成したすべてのクリップを文字起こしして台本と比較します。 誤り率が低いほど、台本どおりに読み上げられた割合が高いことを意味します。
  • Sonic 3.6はLightning v3.1 Proより単語の読み違いが少なく、名前、数字、コードを記載どおりに伝えます。

単語誤り率

低いほど良い

Coval2026年9月
1.85%
2.22%
Sonic 3.6
Cartesia
Lightning v3.1 Pro
Smallest AI

速度

Lightning v3.1 ProよりSonic 3.6の生成が速い

  • Artificial Analysisは掲載するすべてのモデルを同じ測定環境で計測し、 1秒あたりの生成文字数を比較します。
  • Sonic 3.6は毎秒119.1文字、Lightning v3.1 Proは95.5文字を生成します。

1秒あたりの文字数

高いほど良い

Artificial Analysis2026年9月
119.1
95.5
Sonic 3.6
Cartesia
Lightning v3.1 Pro
Smallest AI

企業がSmallest AIではなくCartesiaを選ぶ理由

CartesiaSmallest AI
  1. 人間らしい自然さ

    Artificial Analysis
    Cartesia
    1276 Elo
    Smallest AI
    1171 EloLightning v3.1 Pro1022 EloLightning v3.1

    2026年9月

  2. 遅延

    Coval
    Cartesia
    P95で398ms
    Smallest AI
    697ms at P95Lightning v3.1 Pro

    2026年9月

  3. 認識精度

    Coval
    Cartesia
    単語誤り率1.85%
    Smallest AI
    単語誤り率2.22%Lightning v3.1 Pro

    2026年9月

  4. 速度

    Artificial Analysis
    Cartesia
    毎秒119.1文字
    Smallest AI
    毎秒95.5文字Lightning v3.1 Pro

    2026年9月

  5. 言語一覧

    Cartesia
    1つのモデルで44言語とネイティブなアクセントに対応
    Smallest AI
    Lightning v3.1 Proで31言語
  6. プロ音声クローン

    Cartesia
    30分の音声から、公開APIでセルフサービス利用
    Smallest AI
    Enterpriseプランのみ

よくある質問

品質スコアはどう測定されていますか?

独立したベンチマークであるArtificial Analysisの結果です。リスナーはモデル名を知らされずに同じ文の2つのクリップを聴き、好みの方を選びます。Sonic 3.6は掲載されたSmallest AIの両モデル、Lightning v3.1 ProとLightning v3.1より高く評価されています。

CartesiaはSmallest AIと比べてどれくらい速いですか?

Covalの独立したテストでは、20回に1回の遅い応答に相当するP95で、Sonic 3.6は398msで最初の音声を返し、Lightning v3.1 Proは697msです。Covalは各社の公開APIを呼び出し、すべてのリクエストを計測します。

Cartesiaは名前や数字をどれくらい正確に読み上げますか?

Covalのテストで、Sonic 3.6の単語誤り率は1.85%、Lightning v3.1 Proは2.22%です。Covalは各生成クリップを文字起こしして台本と比較します。

Cartesiaは何言語に対応していますか?

1つのモデルで英語、スペイン語、フランス語、ドイツ語、日本語など44言語に対応しています。英語モデルに後付けするのではなく、地域ごとにアクセントを調整しています。Smallest AIはLightning v3.1 Proで31言語に対応するとしています。

Smallest AIからの移行にはどれくらいかかりますか?

多くのチームで1〜2週間です。Cartesiaは主要な音声エージェントプラットフォームと統合され、すべてのモデルを公開APIで利用できます。別のプラットフォームに移る必要も、後から依存関係を解く手間もありません。

今すぐ始める

専門家に相談する。

音声体験の開発にCartesiaをどう活用できるか、私たちのチームにご相談ください。

営業に問い合わせる

開発を始める。

APIでモデルにアクセスし、数分で音声エージェントを本番環境に導入できます。

Cartesiaを試す