Cartesia가 Together AI Voice Platform의 전담 모델 파트너가 되었으며, 텍스트 음성 변환 모델 Sonic이 Together 기업 고객을 위한 기본 엔드포인트로 제공됩니다. Together에서 개발하는 45만 개 이상의 팀과 개발자는 이제 스위치를 켜듯 간단하게 세계에서 가장 빠른 TTS를 통합할 수 있습니다.
Together AI는 상태 공간 모델을 기반으로 한 Cartesia의 선구적인 아키텍처가 훨씬 빠르고 비용 효율적이며 프로덕션에 바로 사용할 수 있는 AI 개발을 가능하게 한다는 이유로 파트너십을 선택했습니다. 이 협업은 하나의 계층만이 아니라 전체 음성 스택을 최적화합니다. 실시간 기업 음성의 실제 구현은 다음과 같습니다.
- 매우 낮은 지연 시간. Together AI Voice Platform은 하나의 고성능 인프라에 STT, LLM, TTS를 함께 배치해 플랫폼 간 지연을 없앱니다. 눈 깜박임보다 빠른 Cartesia의 100ms 미만 모델은 음성이 병목이 되지 않게 합니다. 그 결과 실시간 음성 애플리케이션을 진정한 상호작용으로 만드는 엔드투엔드 지연 시간을 달성합니다.
- 뛰어난 정확성과 안정성: Cartesia 모델은 다른 모델이 놓치는 영숫자, 기술 용어, 경계 사례의 입력을 42개 언어와 수백 개의 다양한 음성 옵션에서 높은 정확도로 처리합니다. 벤치마크뿐 아니라 현실에서 작동합니다.
- 기업 규모의 확장성: 프로덕션용 인프라는 대규모 배포의 개발 시간과 운영 비용을 크게 줄입니다. 컨택 센터, 의료, 금융 서비스, 규제 산업의 Together 고객은 이제 가장 까다로운 환경을 위해 구축된 프로덕션용 음성 스택을 사용할 수 있습니다.
Together AI는 실시간 음성의 표준으로 Cartesia를 선택한 세계적인 AI 인프라 플랫폼 대열에 합류했습니다. 이번 파트너십은 Sonic 출시 이후 프로덕션에서 이어져 온 관계의 자연스러운 확장입니다. Together의 GPU 클러스터에서는 매일 수백만 분의 오디오가 처리되고 있습니다.
업계를 선도하는 Cartesia 모델을 Together AI에 제공하게 되어 기쁩니다. 이 모델들을 함께 배치함으로써 실시간 음성 에이전트의 발전을 막아온 지연 시간의 장벽을 없애고, 고객이 이전보다 더 빠르고 유연한 대화 경험을 만들 수 있도록 합니다.