Presentamos Speech Engine
ElevenLabs Speech Engine añade voz en tiempo real a tu propio agente de chat o LLM. ElevenLabs gestiona la conversión de voz a texto, los turnos de conversación, la conversión de texto a voz y la reproducción en el navegador, mientras tu servidor controla la lógica del agente y transmite el texto de respuesta a través de un WebSocket de Speech Engine. Úsalo si quieres añadir voz a un entorno de ejecución personalizado en lugar de usar una configuración de ElevenAgents totalmente alojada.
ElevenAgents
- Anulaciones de comportamiento del texto: Se ha añadido
text_behavior_overrides, un mapa porConversationInitiationSourcede objetosBehaviorOverridecon campos opcionalesverbosity,output_formateinteraction_budgetpara el comportamiento del agente específico de cada canal. - Fuentes de integración: Se han añadido Intercom, Telegram y Freshdesk.
- Trazas de conversaciones OTLP: Obtener detalles de la conversación ahora acepta un parámetro de consulta opcional
format. Estableceformat=otlp_tracespara devolver datos de trazas compatibles con OTLP junto con la carga útil estándar de la conversación. - Anulaciones de palabras clave de ASR: Se han añadido los esquemas
ASRConversationalConfigOverrideyASRConversationalConfigOverrideConfigcon arrays opcionaleskeywords, integrados en los modelos de anulación de cliente de configuración de conversación. - Metadatos de autenticación de webhooks: Los esquemas de configuración de herramientas de webhook ahora exponen
auth_resolved_paramsopcional (array de cadenas) que documenta los marcadores de posición de URL resueltos desde la conexión de autenticación.
Música
- Modo de generación: Se ha añadido
MusicGenerationMode(track,loop,ambience) y un campo opcionalgeneration_modeen los cuerpos de solicitud de prompts de música. - Modelo de vídeo a música: Vídeo a música (
POST /v1/music/video-to-music) ahora aceptamodel_idopcional (cadena, valor predeterminadomusic_v1).
ElevenCreative Studio
- Créditos de conversión: Los modelos de respuesta de estadísticas de conversión de capítulos y voces ahora incluyen
credits_needed_to_convertopcional (entero), que indica los créditos necesarios antes de la conversión.
Espacios de trabajo
- Tipos de recursos: Se ha añadido
studio_projectsaWorkspaceResourceType.
Lanzamientos de SDK
SDK de Python
- v2.50.0 - Se ha regenerado el SDK para el esquema de la API del 25 de mayo de 2026.
- v2.49.1 - Se han actualizado las llamadas a la API de Speech Engine para devolver el objeto de respuesta completo.
- v2.49.0 - Se ha regenerado el SDK para el esquema de la API del 18 al 25 de mayo de 2026, incluidas las anulaciones de comportamiento del texto de ElevenAgents,
generation_modede música ystudio_projectsde espacios de trabajo.
SDK de JavaScript
- v2.50.0 - Se han añadido métodos y pruebas que faltaban en la API de Música, y se ha regenerado el SDK para el esquema de la API del 25 de mayo de 2026.
- v2.49.1 - Se han actualizado las llamadas a la API de Speech Engine para devolver el objeto de respuesta completo.
- v2.49.0 - Se ha regenerado el SDK para el esquema de la API del 18 al 25 de mayo de 2026, incluidas las anulaciones de comportamiento del texto de ElevenAgents,
generation_modede música ystudio_projectsde espacios de trabajo.
Paquetes
- @elevenlabs/client@1.8.1 - Se ha corregido que Safari en iOS descartara el primer mensaje del agente en sesiones de voz por WebSocket, desbloqueando un
AudioContextcon el primer gesto del usuario y preparando el grafo de reproducción tras cargar el audio worklet. - @elevenlabs/convai-widget-core@0.12.8 y @elevenlabs/convai-widget-embed@0.12.8 - Se aplican estilos a las etiquetas de emoción y audio en las transcripciones de voz cuando
strip_audio_tagsestá desactivado, y se consideran un interruptor de desactivación para el modal de términos y condiciones los valores nulos de nivel superior determs_htmloterms_text. - @elevenlabs/convai-widget-core@0.12.7 y @elevenlabs/convai-widget-embed@0.12.7 - Se han actualizado las dependencias del widget a
@elevenlabs/client@1.8.1.
API
Ver cambios de la API
Rutas y esquemas actualizados
ElevenAgents
- Obtener detalles de la conversación -
GET /v1/convai/conversations/{conversation_id}- Se ha añadido el parámetro de consulta opcional
format;otlp_tracesdevuelve datos de trazas compatibles con OTLP
- Se ha añadido el parámetro de consulta opcional
- Esquemas de configuración de agentes
- Se ha añadido el mapa
text_behavior_overridesindexado porConversationInitiationSourcecon valoresBehaviorOverride(verbosity,output_format,interaction_budget)
- Se ha añadido el mapa
- Enumeración
ConversationInitiationSource- Se han añadido
intercom_integration,telegram_integrationyfreshdesk_integration
- Se han añadido
- Esquemas de anulación de ASR
- Se han añadido
ASRConversationalConfigOverrideyASRConversationalConfigOverrideConfigconkeywordsopcional (array de cadenas)
- Se han añadido
- Esquemas de herramientas de webhook
- Se ha añadido
auth_resolved_paramsopcional (array de cadenas) en los modelos de configuración de webhook
- Se ha añadido
Música
- Vídeo a música -
POST /v1/music/video-to-music- Se ha añadido
model_idopcional (cadena, valor predeterminadomusic_v1)
- Se ha añadido
- Esquemas de solicitud de prompts de música
- Se ha añadido
generation_modeopcional que hace referencia aMusicGenerationMode(track,loop,ambience)
- Se ha añadido
ElevenCreative Studio
- Esquemas de estadísticas de conversión de capítulos y voces
- Se ha añadido
credits_needed_to_convertopcional (entero)
- Se ha añadido
Espacios de trabajo
- Enumeración
WorkspaceResourceType- Se ha añadido
studio_projects
- Se ha añadido