Doblaje

  • Formato de transcripción JSON: Hemos añadido compatibilidad con transcripciones en formato JSON en la ruta GET /v1/dubbing/{dubbing_id}/transcript/{language_code}, que devuelve datos detallados de temporización a nivel de palabra y carácter mediante DubbingTranscriptResponseModel.

Plataforma Agents

  • Compatibilidad con GPT-5.1: Hemos añadido compatibilidad con los modelos LLM gpt-5.1 y gpt-5.1-2025-11-13 en las configuraciones de agentes.
  • Control del esfuerzo de razonamiento: Hemos añadido la opción none a LLMReasoningEffort para mejorar el control sobre el comportamiento de razonamiento del modelo.
  • Eventos de solicitud de herramientas del agente: Hemos añadido agent_tool_request a ClientEvent para mejorar el seguimiento de la interacción con herramientas en conversaciones en tiempo real.
  • DTMF fuera de banda: Hemos añadido la marca use_out_of_band_dtmf a PlayDTMFToolConfig para mejorar la integración de telefonía.
  • Nuevos modelos LLM: Hemos ampliado la enumeración LLM con gemini-3-pro-preview para mejorar las capacidades de IA conversacional.

Voz a Texto

  • Eventos de cuota de Scribe superada: Hemos añadido el evento quota_exceeded en los SDK y el parámetro include_timestamps para mejorar la gestión de cuotas y el control de marcas de tiempo.

ElevenCreative Studio

  • Seguimiento de voces por capítulo: Hemos añadido el campo voice_ids a los modelos de respuesta de capítulos para mejorar la gestión de voces en proyectos con varias voces.
  • Recursos de imagen de proyecto: Hemos incorporado ProjectImageResponseModel para admitir recursos de imagen, que ahora se incluye en ProjectResponseModel.assets.
  • Campo de voces base: Hemos añadido el campo base_voices a ProjectResponseModel para mejorar la gestión de voces.

Texto a Voz

  • Control de normalización de texto: Hemos añadido la enumeración TextNormalisationType y el campo text_normalisation_type en la configuración de voz de TTS para controlar de forma precisa el procesamiento de texto.
  • Tokens de WebSocket para TTS: Hemos ampliado SingleUseTokenType con tts_websocket para una autenticación segura de WebSocket.

Lanzamientos de SDK

SDK de JavaScript

  • v2.25.0 - Actualizado con los últimos cambios en el esquema de la API, incluidas las transcripciones de doblaje en JSON y la compatibilidad con GPT-5.1
  • v2.24.1 - Hemos añadido el parámetro include_timestamps a la API de Scribe para controlar las marcas de tiempo en las transcripciones

SDK de Python

  • v2.24.0 - Actualizado con los últimos cambios en el esquema de la API, incluidas las transcripciones de doblaje en JSON y la compatibilidad con GPT-5.1
  • v2.23.0 - Hemos añadido el parámetro include_timestamps y el evento quota_exceeded a la API de Scribe para mejorar la gestión de cuotas

Paquetes

  • @elevenlabs/react@0.11.0 - Hemos añadido el evento quota_exceeded y el parámetro include_timestamps para la integración con Scribe
  • @elevenlabs/client@0.11.0 - Hemos añadido el evento quota_exceeded y el parámetro include_timestamps para la integración con Scribe

API

Rutas actualizadas

Doblaje

  • GET /v1/dubbing/{dubbing_id}/transcript/{language_code}
    • El parámetro de ruta language ahora acepta el valor 'original'
    • El parámetro de consulta format_type ahora admite 'json' (además de srt y webvtt)
    • La respuesta 200 ahora incluye el tipo de medio application/json, que devuelve DubbingTranscriptResponseModel con:
      • DubbingTranscriptUtterance - Datos a nivel de enunciado
      • DubbingTranscriptWord - Temporización a nivel de palabra
      • DubbingTranscriptCharacter - Temporización a nivel de carácter
  • Hemos añadido la enumeración DubbingModel con los valores dubbing_v2 y dubbing_v3

Plataforma Agents

  • Enviar llamadas por lotes
    • Esquema del cuerpo de solicitud actualizado (compatible con versiones anteriores)
    • Esquema de respuesta actualizado (compatible con versiones anteriores)
  • Obtener estado de llamadas por lotes
    • Esquema de respuesta actualizado (compatible con versiones anteriores)
  • Cancelar llamadas por lotes
    • Esquema de respuesta actualizado (compatible con versiones anteriores)
  • Reintentar llamadas por lotes
    • Esquema de respuesta actualizado (compatible con versiones anteriores)
  • Obtener configuración de agente
    • Esquema de respuesta actualizado (compatible con versiones anteriores)
  • Actualizar configuración de agente
    • Esquemas de solicitud y respuesta actualizados (compatibles con versiones anteriores)
  • Crear agente
    • Esquema de solicitud actualizado con una estructura de medidas de protección mejorada (cambio incompatible: se ha simplificado guardrails como referencia directa y eliminado oneOf)
  • Obtener agente
    • Esquema de respuesta actualizado (cambio incompatible: se han eliminado los campos version_id y branch_id protegidos por flags de función)
  • Actualizar agente
    • Esquema de respuesta actualizado (cambio incompatible: se han eliminado los campos version_id y branch_id protegidos por flags de función)
  • Simular conversación
    • Esquema de solicitud actualizado (compatible con versiones anteriores)
  • Simular flujo de conversación
    • Esquema de solicitud actualizado (compatible con versiones anteriores)
  • Obtener conversación
    • Esquema de respuesta actualizado (compatible con versiones anteriores)
  • Eventos de cliente actualizados:
    • Hemos añadido el tipo de evento agent_tool_request
  • Configuraciones de herramientas actualizadas:
    • Hemos añadido use_out_of_band_dtmf a PlayDTMFToolConfig
    • Hemos eliminado los esquemas ApiIntegrationWebhookToolConfigExternal-* y sus asignaciones de discriminador

Texto a Voz

Gestión de voces

ElevenCreative Studio

  • Obtener proyecto
    • Esquema de respuesta actualizado (compatible con versiones anteriores)
    • Hemos añadido el campo assets con compatibilidad para imágenes
    • Hemos añadido el campo base_voices
  • Añadir capítulo
    • Esquema de respuesta actualizado (compatible con versiones anteriores)
    • Hemos añadido el campo voice_ids
  • Obtener capítulo
    • Esquema de respuesta actualizado (compatible con versiones anteriores)
    • Hemos añadido el campo voice_ids
  • Actualizar capítulo
    • Esquema de respuesta actualizado (compatible con versiones anteriores)
    • Hemos añadido el campo voice_ids

Música

Otras actualizaciones

Funciones eliminadas

  • Hemos eliminado las opciones obsoletas eleven_expressive y expressive de las enumeraciones de TTS