1위, 그리고 다시 1위.
Sonic-3.6과 Ink-2를 소개합니다.
음성 생성과 전사 모두에서 1위를 차지한 유일한 모델 제공업체와 함께 전체 음성 스택을 구축하세요. 품질이나 속도를 타협할 필요가 없습니다.
상호작용형 지능을 위한 풀스택.

음성 에이전트를 위해 전체 과정을 함께 설계
실시간 파이프라인 전체에 걸쳐 최적화된 유일한 STT와 TTS.
조립할 필요 없는 하나의 API
한 번의 통합으로 두 모델을 모두 배포하세요. 제공업체를 연결하는 작업은 줄이고 개발에 더 집중할 수 있습니다.
음성의 가장 짧은 응답 루프
기본 제공 발화 차례 감지와 함께 90ms 미만의 TTS, 100ms의 전사 지연 시간을 구현하세요.
Cartesia의 상태 공간 모델은 우리의 AI Voice Agents에 기업 수준의 속도와 품질을 제공합니다… 기업이 실시간으로 이해하고 행동하며 적응할 수 있는 안전하고 확장 가능한 음성 에이전트를 배포하도록 합니다.
Ravi Krishnamurthy, 제품 부사장
Cartesia는, 오늘날 음성 AI를 규정하는 절충 관계가
속도와자연스러움,
정확도와 비용 사이에서
불가피한 것이 아니라 대부분 아키텍처에서 비롯된다고 믿습니다.
올바른 기본 구성 요소는 제약을 우회하는 대신 없앤다고 믿기에 우리는 수년간 상태 공간 모델을 만들고 확장해 왔습니다.
그리고 우리는 Sonic-3.6와 Ink-2를 만들 때 기존 한계 안에서 최적화하기보다 그 한계가 정말 존재해야 하는지 물었습니다.
신뢰할 수 있는 가장 빠른 모델로 구축하세요.
대규모 파운데이션 모델을 위한 새로운 기본 구성 요소인 상태 공간 모델 SSM을 기반으로 합니다. SSM은 매우 낮은 지연 시간, 긴 컨텍스트 추론, 규모가 커져도 뛰어난 효율성을 제공합니다.
선도 기업들이 신뢰합니다. 경험에서 나온 이야기.
성공 사례 살펴보기

고객 후기 (번역)
“조금 더 나아서 Sonic으로 전환한 것이 아닙니다. 다른 어떤 것도 비슷한 수준에 이르지 못했기 때문에 전환했습니다… 전환율이 2.9% 높아졌고 고객 참여도가 12.2% 증가했습니다.”Akshay Ramaswamy
스태프 제품 관리자