Convertissez votre texte en parole dans un fichier MP3
Saisissez votre texte, choisissez une voix et créez votre MP3.
Votre texte, prêt à être écouté
Vérifiez la voix sur un court passage, puis générez un fichier pour votre lecteur. Gardez le texte original pour pouvoir modifier l'enregistrement plus tard.
Préparer le texte
Rédigez le texte à inclure dans le fichier. Développez les abréviations peu courantes et vérifiez les noms, les dates et les nombres avant de générer l'enregistrement final.
Écouter un aperçu
Testez votre texte dans l'aperçu et comparez les voix. Écoutez l'interprétation avant de créer votre fichier MP3.
Enregistrer le MP3
Sélectionnez Créer le MP3, puis téléchargez votre fichier audio. Écoutez-le à nouveau dans le lecteur que votre public utilisera.
Générez un MP3 via l'API
Envoyez votre texte à Sonic, puis enregistrez la réponse au format MP3 pour vos narrations, cours ou lectures dans l'application.
Configurer votre requête
Choisissez la sortie MP3 et incluez votre texte, votre voix et votre modèle dans une requête à l'API Bytes. Envoyez-la depuis votre backend pour garder votre clé API privée.
Enregistrer la réponse audio
Vérifiez que la requête a réussi avant d'enregistrer les octets de la réponse dans un fichier MP3. Traitez d'abord les erreurs API éventuelles, puis écoutez l'audio enregistré pour vérifier le résultat.
- Format
- MP3
- Fréquence d'échantillonnage
- 44.1 kHz
- Débit binaire
- 128 kbps
Choisissez un format pour votre destination
Partez des formats acceptés par votre lecteur. Une intégration téléphonique et une narration téléchargeable peuvent nécessiter des réglages différents.
MP3
Pour la lecture et le partage
Un format audio compressé pour les narrations, les messages d'application et les lecteurs compatibles MP3. Choisissez le débit et la fréquence d'échantillonnage dans votre requête.
WAV
Pour le montage
Un conteneur de fichiers pour l'audio PCM. Utile lorsque votre logiciel de montage ou votre processus de publication attend du WAV plutôt que du MP3 compressé.
Audio brut
Pour une intégration
Des échantillons audio sans en-tête de fichier. Faites correspondre l'encodage et la fréquence d'échantillonnage à votre lecteur ou à votre système téléphonique.
Utilisez votre fichier
Messages téléphoniques fixes
Générez les messages d'accueil et de fermeture à partir de textes validés. Vérifiez que votre système téléphonique accepte MP3 avant l'importation ; certains exigent du WAV ou de l'audio brut.
Audio dans l'application
Enregistrez des instructions parlées ou de courts messages pour votre application. Conservez le texte source avec chaque fichier pour savoir quelle version les utilisateurs entendront.
Évaluation des voix
Comparez les voix avec les mêmes phrases de test. Vérifiez la prononciation et le rythme avant de choisir une voix pour un agent destiné aux clients.
FAQ sur la conversion de texte en MP3
Comment définir le format de sortie API sur MP3 ?
Utilisez le point de terminaison Bytes de synthèse vocale. Définissez output_format sur {"container":"mp3","sample_rate":44100,"bit_rate":128000}. Ajoutez les autres champs requis et l'authentification indiqués dans la référence. Cela sélectionne un MP3 à 44,1 kHz et 128 kbit/s : une configuration possible, pas une obligation pour chaque application. La réponse contient des octets audio, pas une URL de téléchargement JSON.
Puis-je télécharger le résultat en MP3 ?
Oui. Saisissez votre texte dans l'outil ci-dessus, choisissez une voix et sélectionnez Créer le MP3. Lorsque le fichier est prêt, sélectionnez Télécharger le MP3. Pour une application, demandez du MP3 à l'API Bytes et enregistrez la réponse réussie dans un fichier .mp3.
La conversion de texte en MP3 est-elle gratuite ?
Vous pouvez écouter et télécharger de courts exemples MP3 sur cette page sans compte. La génération API consomme les crédits de votre compte. Consultez les offres actuelles de Cartesia pour les crédits inclus, les dépassements et les droits commerciaux.
Faut-il utiliser MP3 ou PCM pour un agent vocal en temps réel ?
Utilisez le format attendu par votre intégration. Le MP3 compresse l'audio pour la lecture de fichiers ; le PCM représente les échantillons sans cette compression. Un appel en direct peut exiger un encodage brut et une fréquence précise plutôt que du MP3. Consultez le guide d'intégration audio avant de choisir. Un téléchargement rapide ne mesure pas la latence conversationnelle de bout en bout.
Quelles langues et quels réglages vocaux puis-je utiliser ?
Consultez la documentation Sonic actuelle pour les langues. Les modèles compatibles disposent de réglages de volume, vitesse et émotion. Testez votre voix dans chaque langue cible. Vérifiez les noms, abréviations et nombres : la génération vocale nécessite toujours une validation pour votre usage.
Puis-je utiliser la parole générée comme accueil de serveur vocal interactif ?
Oui, si le système téléphonique accepte le format et que vous détenez les droits sur la voix et le texte. Générez les accueils fixes depuis des textes validés et testez-les par téléphone. Un accueil préenregistré n'interprète pas la réponse de l'appelant. Pour les appels interactifs, découvrez Cartesia Managed Agents.
L'aperçu de cette page permet-il de télécharger un MP3 ?
Oui. Créer le MP3 génère un fichier à partir du texte, de la voix et de la langue sélectionnés. Télécharger le MP3 apparaît après la génération. Modifier le texte ou la voix efface le téléchargement précédent pour permettre la création d'un nouveau fichier.
Quelle différence entre fréquence d'échantillonnage et débit MP3 ?
La fréquence indique combien de fois l'audio est échantillonné chaque seconde. Le débit indique la quantité de données audio compressées enregistrée par seconde. Choisissez des paramètres compatibles avec votre lecteur. L'exemple utilise 44 100 échantillons par seconde et 128 000 bits par seconde ; ces valeurs ne sont pas obligatoires pour chaque projet.
Puis-je transformer un document ou un PDF en MP3 ?
Copiez le texte à prononcer et vérifiez-le avant la génération. Retirez les numéros de page, les titres répétés et les éléments à ne pas lire. L'API accepte du texte ; cette page n'extrait pas le texte d'un PDF importé.
Pourquoi mon MP3 enregistré ne se lit-il pas ?
Vérifiez d'abord la réussite de la requête API et l'enregistrement de la réponse en audio binaire. Confirmez que vous avez demandé un conteneur MP3 et que le lecteur accepte ses paramètres. Renommer un WAV avec l'extension .mp3 ne convertit pas le format audio.
Comment préparer un texte long pour une narration MP3 ?
Commencez par un court extrait pour choisir la voix et vérifier la prononciation. Organisez le texte en sections vérifiables séparément, avec la même voix et les mêmes paramètres de sortie. Écoutez chaque raccord avant d'assembler la narration finale. Conservez le texte source pour qu'une correction ultérieure ne nécessite pas de tout réécrire.
Continuez avec votre voix
Comparez des voix pour votre prochain texte ou découvrez comment générer de la parole depuis votre application.
Trouver une voix pour votre texte
Comparez les voix sur un court passage avant de produire le fichier final. Utilisez le générateur vocal pour entendre comment chaque voix interprète vos mots.
Essayer le générateur vocalGénérer de l'audio avec Python
Configurez le SDK Python et envoyez votre première requête de synthèse vocale. Commencez avec l'exemple complet, puis choisissez le format de sortie adapté à votre projet.
Développer avec PythonCommencer aujourd'hui
Parlez à un expert.
Échangez avec notre équipe et découvrez comment Cartesia peut vous aider à créer des expériences vocales de premier plan.
Commencez à développer.
Accédez à nos modèles via l'API et mettez un agent vocal en production en quelques minutes.