오늘 Sonic Multilingual에서 힌디어, 이탈리아어, 한국어, 네덜란드어, 폴란드어, 러시아어, 스웨덴어, 튀르키예어 등 8개 언어의 알파 버전을 출시합니다. 총 지원 언어는 15개입니다. 업계 최고 수준의 짧은 지연 시간, 높은 평가를 받은 대화 품질, 음성 설계 등 Sonic 영어 버전의 기능을 다국어에서도 그대로 사용할 수 있습니다.
더 많은 사람이 업계 최고 수준의 실시간 음성 생성을 이용할 수 있게 되었습니다.
Sonic의 지원 범위 확대
Sonic Multilingual은 Sonic 음성 모델의 기능을 확장해 개발자와 사용자가 여러 언어와 지역을 아우르는 사실적인 음성 애플리케이션을 만들도록 돕습니다. 지원 언어는 다음과 같습니다.
- 독일어 (de) - Deutsch
- 포르투갈어 (pt) - Português
- 중국어 (zh) - 中文
- 일본어 (ja) - 日本語
- 프랑스어 (fr) - Français
- 스페인어 (es) - Español
- 힌디어 (hi) - हिन्दी
- 이탈리아어 (it) - Italiano
- 한국어 (ko) - 한국어
- 네덜란드어 (nl) - Nederlands
- 폴란드어 (pl) - Polski
- 러시아어 (ru) - Русский
- 스웨덴어 (sv) - Svenska
- 튀르키예어 (tr) - Türkçe
사용 방법
Sonic Multilingual의 작동 모습을 라이브 데모에서 확인하세요. 여러 언어로 짧은 지연 시간에 사실적인 음성을 생성하는 모습을 볼 수 있습니다. 영상은 원래 녹화된 언어를 유지합니다.
다음 순서로 Sonic Multilingual을 시작하세요.
- 애플리케이션이나 API에서 “sonic-multilingual” 모델을 선택합니다.
- 제공되는 14개 옵션 중 원하는 언어를 선택합니다.
- 모델이 말할 텍스트를 입력합니다.
- 음성 라이브러리에서 목소리를 고릅니다. 최상의 성능을 위해 입력 텍스트의 언어에 맞는 음성을 권장합니다.
- “Speak” 버튼을 눌러 지연 시간이 짧은 사실적 음성 생성을 확인합니다.
- 저장하려면 “Download” 버튼을 눌러 오디오를 다운로드합니다.
상태 공간 모델 기반
모든 Cartesia 모델과 마찬가지로 Sonic Multilingual은 상태 공간 모델, SSM 아키텍처를 기반으로 합니다. 근본적으로 더 효율적인 이 방식으로 오디오처럼 해상도가 높은 모달리티를 실시간으로 처리하고 생성합니다. Cartesia 팀이 처음 개발한 S4와 Mamba 같은 상태 공간 모델은 시퀀스 길이에 따라 비용이 거의 선형으로 증가하므로, 지연 시간이 짧은 고품질 음성 생성에 적합합니다.
함께 만들어요
Sonic으로 실시간 대화형 AI를 만드는 데 협력하고 싶다면 연락해 주세요.
- 가입하고 새로운 다국어 기능을 사용해 보세요. 우선 지원, 맞춤 SLA, 사용량 할인 등이 필요하면 엔터프라이즈 문의 양식을 작성하세요.
- 모든 기기에 실시간 멀티모달 지능을 제공하는 일에 관심이 있다면 팀에 합류하세요. 모든 직무에서 채용 중입니다.
