1위, 그리고 다시 1위.

Sonic-3.6과 Ink-2를 소개합니다.

음성 생성과 전사 모두에서 1위를 차지한 유일한 모델 제공업체와 함께 전체 음성 스택을 구축하세요. 품질이나 속도를 타협할 필요가 없습니다.

상호작용형 지능을 위한 풀스택.

Ink 음성 텍스트 변환과 Sonic 텍스트 음성 변환이 에이전트 설정, LLM, API, 가드레일, 도구를 하나의 실시간 파이프라인으로 연결합니다

음성 에이전트를 위해 전체 과정을 함께 설계

실시간 파이프라인 전체에 걸쳐 최적화된 유일한 STT와 TTS.

조립할 필요 없는 하나의 API

한 번의 통합으로 두 모델을 모두 배포하세요. 제공업체를 연결하는 작업은 줄이고 개발에 더 집중할 수 있습니다.

음성의 가장 짧은 응답 루프

기본 제공 발화 차례 감지와 함께 90ms 미만의 TTS, 100ms의 전사 지연 시간을 구현하세요.

Cartesia의 상태 공간 모델은 우리의 AI Voice Agents에 기업 수준의 속도와 품질을 제공합니다… 기업이 실시간으로 이해하고 행동하며 적응할 수 있는 안전하고 확장 가능한 음성 에이전트를 배포하도록 합니다.

Ravi Krishnamurthy, 제품 부사장

Cartesia는, 오늘날 음성 AI를 규정하는 절충 관계가

속도와자연스러움,

정확도와 비용 사이에서

불가피한 것이 아니라 대부분 아키텍처에서 비롯된다고 믿습니다.

올바른 기본 구성 요소는 제약을 우회하는 대신 없앤다고 믿기에 우리는 수년간 상태 공간 모델을 만들고 확장해 왔습니다.

그리고 우리는 Sonic-3.6와 Ink-2를 만들 때 기존 한계 안에서 최적화하기보다 그 한계가 정말 존재해야 하는지 물었습니다.

신뢰할 수 있는 가장 빠른 모델로 구축하세요.

대규모 파운데이션 모델을 위한 새로운 기본 구성 요소인 상태 공간 모델 SSM을 기반으로 합니다. SSM은 매우 낮은 지연 시간, 긴 컨텍스트 추론, 규모가 커져도 뛰어난 효율성을 제공합니다.

선도 기업들이 신뢰합니다. 경험에서 나온 이야기.

성공 사례 살펴보기
2X Solutions logo
arini logo
toby logo