Unir varias solicitudes
Esta guía te muestra cómo mantener la prosodia de la voz en varios fragmentos de texto o generaciones.
Guía práctica · Da por hecho que has completado la guía de inicio rápido de ElevenAPI.
Al convertir una gran cantidad de texto en audio, es posible que notes cambios bruscos en la prosodia de un fragmento a otro. Esto puede ser especialmente perceptible al convertir texto que abarca varios párrafos o secciones. Para mantener la prosodia de la voz entre varios fragmentos, puedes usar la función de unión de solicitudes.
Esta función te permite proporcionar contexto sobre lo que ya se ha generado y lo que se generará después, lo que ayuda a mantener una voz y una prosodia coherentes en todo el texto.
eleven_v3.Aquí tienes un ejemplo sin unión de solicitudes:
Y el mismo ejemplo con unión de solicitudes:
Cómo usar la unión de solicitudes
La unión de solicitudes es más sencilla cuando usas los SDK de ElevenLabs.
Esta guía da por hecho que has configurado tu clave de API y el SDK. Completa primero la guía de inicio rápido si aún no lo has hecho.
Preguntas frecuentes
¿Cómo funciona la unión de solicitudes con streaming?
Para usar los ID de solicitud de una solicitud anterior como condicionamiento, esta debe haberse procesado por completo. En el caso del streaming, esto significa que el audio debe leerse completamente del cuerpo de la respuesta.
¿Qué diferencia supone la unión de solicitudes?
La diferencia depende del modelo, la voz y la configuración de voz utilizados.
¿Cuánto tiempo pueden tener los ID de solicitud?
Los ID de solicitud no deben tener más de dos horas.
¿La unión de solicitudes está disponible en todos los planes?
Sí, salvo si eres un usuario enterprise con requisitos de privacidad más estrictos.