Presentamos Speech Engine

ElevenLabs Speech Engine añade voz en tiempo real a tu propio agente de chat o LLM. ElevenLabs gestiona la conversión de voz a texto, los turnos de conversación, la conversión de texto a voz y la reproducción en el navegador, mientras tu servidor controla la lógica del agente y transmite el texto de respuesta a través de un WebSocket de Speech Engine. Úsalo si quieres añadir voz a un entorno de ejecución personalizado en lugar de usar una configuración de ElevenAgents totalmente alojada.

ElevenAgents

  • Anulaciones de comportamiento del texto: Se ha añadido text_behavior_overrides, un mapa por ConversationInitiationSource de objetos BehaviorOverride con campos opcionales verbosity, output_format e interaction_budget para el comportamiento del agente específico de cada canal.
  • Fuentes de integración: Se han añadido Intercom, Telegram y Freshdesk.
  • Trazas de conversaciones OTLP: Obtener detalles de la conversación ahora acepta un parámetro de consulta opcional format. Establece format=otlp_traces para devolver datos de trazas compatibles con OTLP junto con la carga útil estándar de la conversación.
  • Anulaciones de palabras clave de ASR: Se han añadido los esquemas ASRConversationalConfigOverride y ASRConversationalConfigOverrideConfig con arrays opcionales keywords, integrados en los modelos de anulación de cliente de configuración de conversación.
  • Metadatos de autenticación de webhooks: Los esquemas de configuración de herramientas de webhook ahora exponen auth_resolved_params opcional (array de cadenas) que documenta los marcadores de posición de URL resueltos desde la conexión de autenticación.

Música

  • Modo de generación: Se ha añadido MusicGenerationMode (track, loop, ambience) y un campo opcional generation_mode en los cuerpos de solicitud de prompts de música.
  • Modelo de vídeo a música: Vídeo a música (POST /v1/music/video-to-music) ahora acepta model_id opcional (cadena, valor predeterminado music_v1).

ElevenCreative Studio

  • Créditos de conversión: Los modelos de respuesta de estadísticas de conversión de capítulos y voces ahora incluyen credits_needed_to_convert opcional (entero), que indica los créditos necesarios antes de la conversión.

Espacios de trabajo

  • Tipos de recursos: Se ha añadido studio_projects a WorkspaceResourceType.

Lanzamientos de SDK

SDK de Python

  • v2.50.0 - Se ha regenerado el SDK para el esquema de la API del 25 de mayo de 2026.
  • v2.49.1 - Se han actualizado las llamadas a la API de Speech Engine para devolver el objeto de respuesta completo.
  • v2.49.0 - Se ha regenerado el SDK para el esquema de la API del 18 al 25 de mayo de 2026, incluidas las anulaciones de comportamiento del texto de ElevenAgents, generation_mode de música y studio_projects de espacios de trabajo.

SDK de JavaScript

  • v2.50.0 - Se han añadido métodos y pruebas que faltaban en la API de Música, y se ha regenerado el SDK para el esquema de la API del 25 de mayo de 2026.
  • v2.49.1 - Se han actualizado las llamadas a la API de Speech Engine para devolver el objeto de respuesta completo.
  • v2.49.0 - Se ha regenerado el SDK para el esquema de la API del 18 al 25 de mayo de 2026, incluidas las anulaciones de comportamiento del texto de ElevenAgents, generation_mode de música y studio_projects de espacios de trabajo.

Paquetes

API

Rutas y esquemas actualizados

ElevenAgents

  • Obtener detalles de la conversación - GET /v1/convai/conversations/{conversation_id}
    • Se ha añadido el parámetro de consulta opcional format; otlp_traces devuelve datos de trazas compatibles con OTLP
  • Esquemas de configuración de agentes
    • Se ha añadido el mapa text_behavior_overrides indexado por ConversationInitiationSource con valores BehaviorOverride (verbosity, output_format, interaction_budget)
  • Enumeración ConversationInitiationSource
    • Se han añadido intercom_integration, telegram_integration y freshdesk_integration
  • Esquemas de anulación de ASR
    • Se han añadido ASRConversationalConfigOverride y ASRConversationalConfigOverrideConfig con keywords opcional (array de cadenas)
  • Esquemas de herramientas de webhook
    • Se ha añadido auth_resolved_params opcional (array de cadenas) en los modelos de configuración de webhook

Música

  • Vídeo a música - POST /v1/music/video-to-music
    • Se ha añadido model_id opcional (cadena, valor predeterminado music_v1)
  • Esquemas de solicitud de prompts de música
    • Se ha añadido generation_mode opcional que hace referencia a MusicGenerationMode (track, loop, ambience)

ElevenCreative Studio

  • Esquemas de estadísticas de conversión de capítulos y voces
    • Se ha añadido credits_needed_to_convert opcional (entero)

Espacios de trabajo

  • Enumeración WorkspaceResourceType
    • Se ha añadido studio_projects