À propos de l’entreprise
Cerebrium crée une infrastructure sans serveur pour permettre aux équipes d’IA de déployer des applications en quelques minutes. L’équipe s’intéresse à l’IA en temps réel et à ses possibilités de simuler des interactions humaines très réalistes.
Elle en a montré des applications concrètes dans une démo d’avatars d’IA pour la formation commerciale et les entretiens utilisateurs.
Voici la démo de Cerebrium :
Créer l’avatar d’IA le plus réactif au monde
Cerebrium voulait un avatar d’IA capable de former des commerciaux et d’accompagner des candidats avec la réactivité d’une personne réelle.
Chaque milliseconde compte, car les humains sont impatients et les longues pauses révèlent immédiatement l’IA. Pour cette démo, Cerebrium a donc cherché à réduire la latence tout en conservant la qualité d’une conversation humaine naturelle.
Cerebrium a associé trois technologies :
- Mistral, modèle de langage à 7 milliards de paramètres
- Tavus, avatars d’IA
- Cartesia, API vocale réaliste à faible latence
Avec moins de 100 ms de latence du modèle avant le premier audio, Cartesia est la solution de voix générative la plus rapide du marché. Elle propose aussi les voix les plus réalistes et naturelles, comme le confirment des plateformes d’évaluation indépendantes telles qu’Artificial Analysis, qui organise des tests de préférence humaine à l’aveugle entre les principaux fournisseurs de synthèse vocale.
Cartesia est aussi le seul fournisseur à proposer des réglages précis de conception vocale comme le débit et l’émotion. Les utilisateurs peuvent ainsi s’entraîner dans différents scénarios de vente et d’entretien, avec un interlocuteur en colère ou qui parle trop vite, par exemple.
Nous sommes les seuls à combiner cette rapidité et cette qualité, car notre API vocale repose sur les modèles d’espace d’état, une architecture d’IA fondamentalement plus efficace.
Le résultat est une interaction vocale impossible à distinguer d’un échange avec un coach humain. Elle peut :
- Répondre à l’utilisateur en moins de 500 ms de bout en bout
- Passer du ton d’un client en colère à celui d’un coach encourageant
- Gérer des conversations complexes en tenant compte du contexte
Essayez sur https://coaching.cerebrium.ai/
Pourquoi la latence compte
- Engagement : des réponses rapides rendent les conversations plus naturelles et retiennent les utilisateurs plus longtemps.
- Capacité : une latence réduite permet de gérer davantage d’utilisateurs simultanés sans perdre en qualité.
- Expérience utilisateur : avec l’habitude de réponses immédiates, même de petits retards peuvent frustrer et faire abandonner.
Que vous créiez un bot de service client, un assistant virtuel ou une application éducative, la rapidité est essentielle à une expérience réaliste.
Prêt à ajouter les voix de Cartesia à votre IA ?
La démo de Cerebrium n’est qu’un début. Notre communauté crée déjà d’autres usages :
Une application d’apprentissage des langues qui réagit immédiatement aux erreurs de prononciation.
Un chatbot de santé mentale qui repère les indices émotionnels en temps réel.
Un compagnon d’étude qui vous interroge sur des articles de recherche denses.
Pour comprendre en détail comment Cerebrium a créé son avatar, consultez son article technique.