Diffuser du texte en parole
Ce guide explique comment diffuser du texte en parole et, si nécessaire, importer l’audio vers AWS S3.
Ce guide présente trois approches : générer de la parole sous forme de fichier, diffuser directement la réponse audio en streaming et, en option, téléverser l’audio généré vers un bucket AWS S3 pour le partager via une URL signée.
Ce guide suppose que vous avez configuré votre clé API et votre SDK. Terminez d’abord le guide de démarrage rapide si ce n’est pas déjà fait. La section facultative consacrée au téléversement vers S3 requiert également un compte AWS avec accès à S3.
Vous vous demandez pourquoi le streaming fonctionne ainsi ? Comprendre le streaming audio explique en détail le protocole, la mise en mémoire tampon et les compromis de latence.
Convertir du texte en parole (fichier)
Pour convertir du texte en parole et l’enregistrer dans un fichier, nous utiliserons la méthode convert du SDK ElevenLabs, puis l’enregistrerons localement au format .mp3.
Vous pouvez ensuite exécuter cette fonction avec :
Convertir du texte en parole (streaming)
Si vous préférez diffuser l’audio directement en streaming sans l’enregistrer dans un fichier, vous pouvez utiliser notre fonctionnalité de streaming.
Vous pouvez ensuite exécuter cette fonction avec :
Bonus : téléverser vers AWS S3 et obtenir un lien de partage sécurisé
Une fois vos données audio créées sous forme de fichier ou de flux, vous souhaiterez peut-être les partager avec vos utilisateurs. Vous pouvez notamment les téléverser vers un bucket AWS S3 et générer un lien de partage sécurisé.
Créer vos identifiants AWS
Pour téléverser les données vers S3, vous devez ajouter l’identifiant de votre clé d’accès AWS, votre clé d’accès secrète et le nom de votre région AWS à votre fichier .env. Suivez ces étapes pour trouver ces identifiants :
- Connectez-vous à votre console de gestion AWS : accédez à la page d’accueil AWS et connectez-vous avec votre compte.

- Accédez au Dashboard IAM (Identity and Access Management) : vous trouverez IAM dans la section « Security, Identity, & Compliance » du menu des services. Le Dashboard IAM gère de façon sécurisée l’accès à vos services AWS.

- Créez un nouvel utilisateur, si nécessaire : dans le Dashboard IAM, sélectionnez « Users », puis « Add user ». Saisissez un nom d’utilisateur.

- Définissez les autorisations : associez directement des stratégies à l’utilisateur selon le niveau d’accès que vous souhaitez accorder. Pour les téléversements vers S3, vous pouvez utiliser la stratégie AmazonS3FullAccess. Il est toutefois recommandé d’accorder le minimum de privilèges, soit uniquement les autorisations nécessaires à l’exécution d’une tâche. Vous pouvez créer une stratégie personnalisée qui autorise uniquement les actions nécessaires sur votre bucket S3.

- Vérifiez et créez l’utilisateur : vérifiez vos paramètres et créez l’utilisateur. Lors de sa création, vous recevrez un identifiant de clé d’accès et une clé d’accès secrète. Téléchargez et enregistrez ces identifiants de manière sécurisée ; vous ne pourrez plus récupérer la clé d’accès secrète après cette étape.

- Obtenez le nom de la région AWS : par exemple, us-east-1

Si vous n’avez pas de bucket AWS S3, créez-en un en suivant ces étapes :
- Accédez au Dashboard S3 : vous trouverez S3 dans la section « Storage » du menu des services.

- Créez un bucket : dans le Dashboard S3, cliquez sur le bouton « Create bucket ».

- Saisissez un nom de bucket et cliquez sur le bouton « Create bucket ». Vous pouvez conserver les valeurs par défaut pour les autres options du bucket. Le bucket nouvellement ajouté apparaîtra dans la liste.


Installer le SDK AWS et ajouter les identifiants
Installez boto3 pour interagir avec les services AWS à l’aide de pip et npm.
Ajoutez ensuite les variables d’environnement au fichier .env comme suit :
Téléverser vers AWS S3 et générer l'URL signée
Ajoutez les fonctions suivantes pour téléverser le flux audio vers S3 et générer une URL signée.
Vous pouvez ensuite appeler la fonction de téléversement avec le flux audio issu du texte.
Après avoir téléversé le fichier audio vers S3, générez une URL signée pour partager l’accès au fichier. Cette URL est limitée dans le temps, ce qui signifie qu’elle expire après une certaine période et permet un partage temporaire sécurisé.
Vous pouvez maintenant générer une URL à partir d’un fichier avec :
Si vous souhaitez utiliser le fichier plusieurs fois, stockez le chemin du fichier S3 dans votre base de données et régénérez l’URL signée chaque fois que nécessaire, plutôt que d’enregistrer directement l’URL signée, car elle expirera.
Tout assembler
Pour tout assembler, vous pouvez utiliser le script suivant :
Conclusion
Vous savez désormais convertir du texte en parole et générer une URL signée pour partager le fichier audio. Cette fonctionnalité offre de nombreuses possibilités pour créer et partager du contenu de façon dynamique.
Voici quelques exemples de ce que vous pourriez créer avec cette fonctionnalité.
-
Podcasts éducatifs : créez du contenu éducatif personnalisé, accessible à la demande par les étudiants. Les enseignants peuvent convertir leurs cours au format audio, les téléverser vers S3 et partager les liens avec leurs étudiants pour une expérience d’apprentissage plus engageante, hors du cadre traditionnel de la salle de classe.
-
Fonctionnalités d’accessibilité pour les sites web : améliorez l’accessibilité d’un site web en proposant son contenu textuel au format audio. Les informations deviennent ainsi plus accessibles aux personnes malvoyantes ou à celles qui préfèrent l’apprentissage auditif.
-
Messages automatisés du support client : produisez des messages audio automatisés et personnalisés pour le support client, tels que des FAQ ou des mises à jour de commande. Vous offrez ainsi une expérience client plus engageante que les emails textuels traditionnels.
-
Livres audio et narration : convertissez des livres entiers ou des nouvelles au format audio pour offrir au public une nouvelle manière de profiter de la littérature. Les auteurs et éditeurs peuvent diversifier leur offre de contenu et atteindre les publics qui préfèrent écouter plutôt que lire.
-
Outils d’apprentissage des langues : développez des outils d’apprentissage des langues qui proposent aux apprenants des leçons et exercices audio. Ils peuvent ainsi travailler la prononciation et la compréhension orale de façon ciblée.