고객 사례

Cartesia가 세계에서 가장 반응성 높은 AI 아바타를 구동하는 방법

회사 소개

Cerebrium은 AI 팀이 몇 분 만에 애플리케이션을 배포할 수 있도록 서버리스 인프라를 만듭니다. 팀은 실시간 AI와 이를 통해 매우 사실적인 인간 상호작용을 재현할 수 있다는 가능성에 관심을 갖고 있습니다.

영업 교육과 사용자 인터뷰를 위해 만든 이 데모에서 AI 아바타의 실용적인 활용 사례를 보여주었습니다.

Cerebrium 데모를 확인하세요.

세계에서 가장 반응성 높은 AI 아바타 구축

Cerebrium에는 실제 사람의 반응성으로 영업 담당자를 교육하고 구직자를 코칭할 수 있는 AI 아바타라는 비전이 있었습니다.

사람은 오래 기다리지 않으며, 긴 침묵은 AI와 대화하고 있다는 것을 바로 드러내기 때문에 지연 시간은 1밀리초도 중요합니다. 그래서 Cerebrium은 이 데모의 기술 스택을 구축하면서 자연스러운 사람 대화의 품질을 유지하는 동시에 지연 시간을 최적화하고자 했습니다.

Cerebrium은 세 가지 핵심 기술을 결합해 혁신적인 데모를 만들었습니다.

  1. Mistral: 7B 언어 모델
  2. Tavus: AI 아바타
  3. Cartesia: 저지연의 매우 사실적인 음성 API

첫 오디오까지의 모델 지연 시간이 100ms 미만인 Cartesia는 시장에서 가장 빠른 생성형 음성 솔루션입니다. 또한 모든 주요 텍스트 음성 변환 제공업체를 대상으로 블라인드 사람 선호도 테스트를 수행하는 Artificial Analysis 등 여러 제3자 모델 평가 플랫폼이 확인했듯 가장 사실적이고 자연스러운 음성을 제공합니다.

Cartesia는 속도와 감정 같은 세밀한 음성 설계 제어를 제공하는 유일한 업체이기도 합니다. 덕분에 데모 사용자는 상대가 화를 내거나 너무 빨리 말하는 등 다양한 영업 및 면접 상황을 연습할 수 있습니다.

속도와 품질의 균형을 맞출 수 있는 유일한 제공업체인 이유는 AI 모델에 근본적으로 더 효율적인 아키텍처인 상태 공간 모델(SSM)을 기반으로 음성 API를 구축했기 때문입니다.

그 결과 사람 코치와 말하는 것과 구별하기 어려운 음성 상호작용이 가능해졌습니다. 다음을 할 수 있습니다.

  • 엔드투엔드 500ms 미만으로 사용자 입력에 응답
  • 화난 고객부터 격려하는 코치까지 어조 조정
  • 맥락을 이해하는 복잡한 대화 처리

직접 경험해 보세요: https://coaching.cerebrium.ai/

지연 시간이 중요한 이유

  1. 참여: 빠른 응답은 더 자연스러운 대화를 만듭니다. 사용자가 더 오래 참여합니다.
  2. 확장성: 지연 시간이 낮으면 품질을 희생하지 않고 더 많은 동시 사용자를 처리할 수 있습니다.
  3. 사용자 경험: 즉각적인 만족을 기대하는 환경에서는 작은 지연도 불만과 이탈로 이어질 수 있습니다.

고객 서비스 봇, 가상 비서, 차세대 에듀테크 제품 중 무엇을 만들든 속도는 사실적인 경험의 핵심입니다.

Cartesia 음성으로 AI를 강화할 준비가 되셨나요?

Cerebrium 데모는 시작에 불과합니다. 커뮤니티가 현재 Cartesia 음성으로 구축하는 다른 활용 사례도 있습니다.

발음 오류에 즉시 반응하는 언어 학습 앱

실시간으로 감정적 단서를 포착하는 정신 건강 챗봇

복잡한 연구 논문의 내용으로 퀴즈를 내는 학습 파트너

Cerebrium이 아바타를 구축한 기술적 세부 사항은 심층 블로그 글을 확인하세요.