오늘 오디오 클립의 원래 표현과 감정을 유지하면서 목소리를 바꾸는 새 모델 Voice Changer를 출시합니다.
다양한 스튜디오급 음성 라이브러리에서 고르거나 자신의 목소리를 복제하세요. 발성, 감정, 운율 같은 뉘앙스는 세밀하게 제어할 수 있습니다.
자연스러운 발화 유지
Voice Changer는 원본의 독특하고 자연스러우며 생생한 발화 특성을 그대로 보존합니다.
아래는 《이상한 나라의 앨리스》 12장 “Alice’s Evidence”의 내레이션입니다. 입력을 플레이그라운드의 Child, Movie Guy, Reading Lady, Wizard 네 목소리로 바꿨습니다. 녹음은 원래 언어를 유지합니다.
각 변환 클립이 원래 화자의 표현력, 한숨과 감탄 같은 발성, 운율을 유지하는지 들어보세요. 한 클립 안에서 목소리를 다섯 번 바꿔도 이런 일관성 덕분에 자연스럽게 전환됩니다.
다음 원본 클립을 변환했습니다.
아래는 모두 다른 목소리로 변환한 결과입니다.
말하는 방식까지 세밀하게 제어
Cartesia의 음성 합성은 문맥을 이해하지만, 대본을 읽는 방법을 정확히 지정해야 할 때도 있습니다. Voice Changer는 감정부터 타이밍까지 표현의 모든 측면을 다듬는 제어 기능을 제공합니다.
예시를 비교해 보세요.
사용 사례
Voice Changer는 여러 방식으로 사용할 수 있습니다.
- 크리에이터는 원하는 방식으로 직접 녹음한 뒤 목소리를 바꿔 개성과 감정이 있는 콘텐츠를 만들 수 있습니다.
- 게임과 엔터테인먼트에서는 대사를 원하는 대로 연기하고 각 대사에 캐릭터의 목소리를 적용해 스튜디오급 경험을 만들 수 있습니다.
- 청취자는 좋아하는 오디오북, 강의, 팟캐스트를 바꾸고 캐릭터마다 다른 목소리를 줄 수 있습니다.
- 기업에서는 누구나 브랜드와 목표에 맞는 표현력 있고 사실적인 스튜디오급 오디오를 빠르게 만들 수 있습니다.
Sonic 음성 생성과 Voice Changer를 결합하면 어떤 발화든 생성하고 원하는 소리로 바꿀 수 있습니다.
새로운 사용 사례가 떠오르나요? X의 @cartesia_ai로 공유하거나 개발자 쇼케이스에 제출해 주세요.
시작하기
플레이그라운드에서 Voice Changer를 세 단계로 사용할 수 있습니다.
- 직접 녹음하거나 파일을 업로드합니다.
- 바꾸고 싶은 목소리를 선택합니다.
- 새 목소리의 고품질 오디오를 생성합니다.
자세한 구현 가이드와 API 문서는 개발자 포털을 참고하세요.
상태 공간 모델 기반
다른 Cartesia 모델처럼 Voice Changer도 상태 공간 모델, SSM 아키텍처 연구를 기반으로 합니다. 근본적으로 다른 이 접근법으로 오디오 같은 고해상도 모달리티를 높은 품질로 처리하고 생성합니다. 우리 팀이 처음 개발한 S4와 Mamba 같은 상태 공간 모델은 시퀀스 길이에 따른 비용이 거의 선형으로 늘어 고품질 음성 생성에 적합합니다.
함께 만들어요
개발자와 크리에이터가 Voice Changer로 만들 새 경험이 기대됩니다.
- 가입하고 Voice Changer를 사용해 보세요.
- 맞춤 솔루션, SLA, 사용량 가격이 필요하면 엔터프라이즈 문의 양식을 작성하세요.
- AI의 발전에 함께할 분을 모든 직무에서 채용하고 있습니다.
