텍스트를 음성으로 변환해 MP3 파일로
텍스트를 입력하고 음성을 선택한 뒤 MP3를 만드세요.
내 스크립트, 바로 재생할 수 있게
짧은 구절로 음성을 확인한 뒤 플레이어용 파일을 생성하세요. 나중에 녹음을 수정할 수 있도록 원본 스크립트를 보관하세요.
스크립트 준비
파일에 넣을 텍스트를 작성하세요. 익숙하지 않은 약어는 풀어 쓰고 최종 녹음을 생성하기 전에 이름, 날짜, 숫자를 검토하세요.
미리 듣기
미리보기에서 텍스트를 사용하고 음성을 비교하세요. MP3 파일을 만들기 전에 전달 방식을 들어보세요.
MP3 저장
MP3 생성을 선택한 뒤 오디오 파일을 다운로드하세요. 청중이 사용할 플레이어에서 한 번 더 들어보세요.
MP3를 생성하세요, API를 통해
Sonic에 스크립트를 보내고 응답을 MP3로 저장해 내레이션, 수업, 앱 재생에 사용하세요.
요청 구성
MP3 출력을 선택하고 Bytes API 요청에 전사문, 음성, 모델을 포함하세요. API 키를 비공개로 유지하려면 백엔드에서 요청을 보내세요.
오디오 응답 저장
응답 바이트를 MP3 파일로 저장하기 전에 요청이 성공했는지 확인하세요. 먼저 API 오류를 처리한 뒤 저장된 오디오를 재생해 결과를 확인하세요.
- 형식
- MP3
- 샘플 레이트
- 44.1 kHz
- 비트레이트
- 128 kbps
형식을 선택하세요, 사용 환경에 맞게
플레이어가 지원하는 형식부터 확인하세요. 전화 통합과 다운로드용 내레이션 파일은 서로 다른 설정이 필요할 수 있습니다.
MP3
재생 및 공유용
내레이션, 앱 메시지, MP3를 지원하는 플레이어용 압축 오디오입니다. 요청에서 비트레이트와 샘플 레이트를 선택하세요.
WAV
편집 워크플로용
PCM 오디오용 파일 컨테이너입니다. 편집기나 게시 워크플로가 압축 MP3 대신 WAV를 요구할 때 유용합니다.
원시 오디오
통합용
파일 헤더가 없는 오디오 샘플입니다. 인코딩과 샘플 레이트를 플레이어나 전화 시스템에 맞추세요.
파일 활용하기
고정 전화 안내
검토를 마친 텍스트로 인사말과 영업시간 외 안내를 생성하세요. 업로드 전에 전화 시스템이 MP3를 지원하는지 확인하세요. 일부 시스템은 WAV나 원시 오디오를 요구합니다.
앱 내 오디오
애플리케이션에서 재생할 음성 지침이나 짧은 메시지를 저장하세요. 사용자가 듣게 될 버전을 알 수 있도록 각 파일과 함께 원문을 보관하세요.
음성 평가
같은 테스트 문장으로 음성을 비교하세요. 고객용 에이전트의 음성을 선택하기 전에 발음과 속도를 검토하세요.
텍스트 MP3 변환 FAQ
API 출력 형식을 MP3로 설정하려면 어떻게 하나요?
Text-to-Speech Bytes 엔드포인트를 사용하세요. output_format을 {"container":"mp3","sample_rate":44100,"bit_rate":128000}으로 설정하세요. 참조 문서에 있는 다른 필수 요청 필드와 인증도 포함하세요. 이 설정은 128kbps의 44.1kHz MP3를 선택합니다. 지원되는 구성 중 하나이며 모든 애플리케이션의 필수 조건은 아닙니다. 응답에는 JSON 다운로드 URL이 아닌 오디오 바이트가 포함됩니다.
결과를 MP3 파일로 다운로드할 수 있나요?
네. 위 도구에 텍스트를 입력하고 음성을 선택한 후 MP3 만들기를 선택하세요. 파일이 준비되면 MP3 다운로드를 선택하세요. 애플리케이션에서는 Bytes API에 MP3를 요청하고 성공한 응답을 .mp3 파일로 저장하세요.
텍스트를 MP3 음성으로 변환하는 기능은 무료인가요?
이 페이지에서 계정 없이 짧은 MP3 샘플을 미리 듣고 다운로드할 수 있습니다. API 생성에는 계정의 크레딧이 사용됩니다. 포함된 크레딧, 추가 사용량, 상업적 사용 조건은 Cartesia의 최신 요금제를 확인하세요.
실시간 음성 에이전트에는 MP3와 PCM 중 무엇을 사용해야 하나요?
수신 측 통합이 요구하는 형식을 사용하세요. MP3는 파일 재생을 위해 오디오를 압축하며, PCM은 MP3 압축 없이 오디오 샘플을 표현합니다. 실시간 통화에는 MP3 대신 특정 원시 인코딩과 샘플링 레이트가 필요할 수 있습니다. 출력 설정을 선택하기 전에 오디오 통합 가이드를 확인하세요. 빠른 파일 다운로드는 대화 전체의 지연 시간을 측정하지 않습니다.
어떤 언어와 음성 제어를 사용할 수 있나요?
지원 언어는 최신 Sonic 모델 문서를 확인하세요. 지원 모델에는 음량, 속도, 감정 제어가 있습니다. 선택한 음성을 각 대상 언어로 테스트하세요. 이름, 약어, 숫자를 들어보세요. 음성 생성 결과는 사용 사례에 맞는 검토가 필요합니다.
생성된 음성을 IVR 인사말에 사용할 수 있나요?
네. 전화 시스템이 해당 파일 형식을 지원하고 음성과 텍스트에 필요한 권리를 보유한 경우 사용할 수 있습니다. 검토를 마친 스크립트로 고정 인사말을 생성하고 전화 연결을 통해 테스트하세요. 사전 녹음된 인사말은 발신자의 답변을 해석하지 않습니다. 대화형 통화에는 Cartesia Managed Agents를 살펴보세요.
이 페이지의 미리 보기에서 MP3를 다운로드할 수 있나요?
네. MP3 만들기는 선택한 텍스트, 음성, 언어로 파일을 생성합니다. 생성이 끝나면 MP3 다운로드가 나타납니다. 텍스트나 음성을 바꾸면 이전 다운로드가 지워지므로 변경한 선택으로 새 파일을 만들 수 있습니다.
MP3 샘플링 레이트와 비트레이트의 차이는 무엇인가요?
샘플링 레이트는 초당 오디오를 샘플링하는 횟수입니다. 비트레이트는 초당 저장되는 압축 오디오 데이터의 양입니다. 플레이어에 맞는 지원 설정을 선택하세요. 이 페이지의 예제는 초당 44100개 샘플과 초당 128000비트를 사용합니다. 모든 프로젝트에서 이 설정이 필수인 것은 아닙니다.
문서나 PDF를 MP3로 바꿀 수 있나요?
읽을 텍스트를 복사하고 오디오 생성 전에 검토하세요. 페이지 번호, 반복되는 제목, 소리 내어 읽지 않아야 할 내용을 제거하세요. 음성 API는 텍스트를 받으며, 이 페이지에 업로드한 PDF에서 텍스트를 추출하지는 않습니다.
저장한 MP3가 재생되지 않는 이유는 무엇인가요?
먼저 API 요청이 성공했고 응답을 바이너리 오디오로 저장했는지 확인하세요. MP3 컨테이너를 요청했는지, 플레이어가 선택한 설정을 지원하는지 확인하세요. WAV 파일명의 끝을 .mp3로 바꿔도 오디오 형식은 변환되지 않습니다.
MP3 내레이션용 긴 스크립트는 어떻게 준비해야 하나요?
짧은 발췌문으로 음성을 선택하고 발음을 확인하세요. 긴 스크립트는 개별적으로 검토할 수 있는 구간으로 나누고 같은 음성과 출력 설정을 유지하세요. 편집기에서 최종 내레이션을 완성하기 전에 각 연결 부분을 들어보세요. 나중에 수정할 때 전체 스크립트를 다시 작성하지 않도록 원문을 보관하세요.
내 음성으로 계속 작업
다음 스크립트에 맞는 음성을 비교하거나 애플리케이션에서 음성을 생성하는 방법을 알아보세요.
Python에서 오디오 생성
Python SDK를 설정하고 첫 텍스트 음성 변환 요청을 보내세요. 완전한 예제로 시작한 뒤 프로젝트에 필요한 출력 형식을 선택하세요.
Python으로 개발오늘 시작하세요
전문가와 상담하세요.
팀원과 연결해 Cartesia가 세계적 수준의 음성 경험을 만드는 데 어떻게 도움이 되는지 알아보세요.
개발을 시작하세요.
API로 모델을 사용하고 몇 분 만에 음성 에이전트를 프로덕션에 배포하세요.