Référence des événements en temps réel

Référence des événements reçus depuis l’API Realtime Speech to Text

Référence · Répertorie tous les événements envoyés à l’API WebSocket Realtime Speech to Text et reçus de celle-ci.

Consultez la référence de l’API Realtime Speech to Text pour en savoir plus sur l’API et ses options.

committed_transcript est l’événement final et stable de chaque segment. L’API publique n’émet pas d’événement final_transcript distinct.

Événements envoyés

ÉvénementDescriptionQuand l’utiliser
input_audio_chunkEnvoyer des données audio à transcrireEn continu pendant le streaming audio

Événements reçus

ÉvénementDescriptionMoment de réception
session_startedConfirme la connexion et renvoie la configuration de la sessionImmédiatement après l’établissement de la connexion WebSocket
partial_transcriptMise à jour en direct de la transcription du segment en cours. Les résultats partiels ultérieurs remplacent les précédents. Également envoyé comme signal de maintien : text vide si le segment ne contient aucun texte non validé, ou répétition du dernier résultat partiel dans le cas contrairePendant le traitement audio, avant une validation. Également envoyé comme signal de maintien environ une fois par keepalive_interval_ms lorsqu’il est configuré
committed_transcriptTranscription finalisée d’un segment. Il s’agit du texte final et stable du segment, qui ne changera pasAprès une validation, manuelle ou déclenchée par VAD
committed_transcript_with_timestampsTranscription validée avec horodatages au niveau des mots et language_code détectéEnvoyé après la transcription validée. Reçu uniquement lorsque include_timestamps=true ou include_language_detection=true est inclus dans les paramètres de requête
committed_transcript_entitiesEntités détectées dans le segment de transcription validée, avec leurs décalages de caractèresEnvoyé peu après chaque transcription validée. Reçu uniquement lorsque entity_detection est inclus dans les paramètres de requête
edited_transcriptVersion modifiée du segment de transcription validée, accompagnée du texte validé d’origineEnvoyé peu après chaque transcription validée. Reçu uniquement lorsque transcript_edit est inclus dans les paramètres de requête

Gestion des erreurs

En cas d’erreur, un message d’erreur est renvoyé avant la fermeture de la connexion WebSocket.

Type d’erreurDescription
auth_errorUne erreur est survenue lors de l’authentification de la requête. Vérifiez votre clé API
quota_exceededVous avez dépassé votre quota d’utilisation
transcriber_errorUne erreur est survenue lors de la transcription de l’audio.
input_errorUne erreur est survenue lors du traitement du fragment audio, probablement en raison d’un format d’entrée ou de paramètres non valides
invalid_requestLes paramètres de connexion ont été refusés. Vérifiez les paramètres de requête dans la référence de l’API
errorErreur générique du serveur
commit_throttledLa validation a été limitée en raison d’un trop grand nombre de demandes de validation sur une courte période
unaccepted_termsVous n’avez pas accepté les conditions d’utilisation de Scribe. Consultez et acceptez les conditions générales dans le Dashboard ElevenLabs
rate_limitedVotre débit de requêtes est limité. Réduisez le nombre de requêtes effectuées sur une courte période
queue_overflowLa file de traitement est pleine. Envoyez moins de requêtes sur une courte période
resource_exhaustedLes ressources du serveur sont à pleine capacité. Réessayez plus tard
session_time_limit_exceededLa durée maximale de session a été atteinte. Démarrez une nouvelle session ou effectuez un upgrade de votre abonnement
chunk_size_exceededLa taille du fragment audio est trop importante. Réduisez-la
insufficient_audio_activityVous n’avez pas envoyé suffisamment d’activité audio pour maintenir la connexion