Scribe v2

Hemos lanzado Scribe v2, el nuevo modelo de transcripción más avanzado. Más información sobre Scribe v2 en la documentación.

Plataforma de agentes

  • Compatibilidad con zonas horarias para programar llamadas por lotes: Ahora puedes seleccionar una zona horaria al programar llamadas por lotes. La hora programada se convierte a UTC según la zona horaria elegida. De forma predeterminada, se selecciona automáticamente la zona horaria de tu navegador, y la validación evita programar llamadas para horas que ya han pasado en la zona horaria seleccionada. Esto facilita programar llamadas salientes a la hora adecuada en las zonas horarias de tus destinatarios.
  • URL del archivo fuente de la base de conocimientos: Se ha añadido una nueva ruta para recuperar la URL del archivo fuente original de los documentos de la base de conocimientos, lo que permite acceder directamente a los archivos subidos.
  • Tiempo de espera de la cascada de LLM de respaldo: Se ha añadido la opción de configuración cascade_timeout_seconds para las configuraciones de LLM de respaldo de los agentes, que permite controlar cuánto esperar antes de pasar al siguiente LLM. El valor predeterminado es de 8 segundos y el intervalo permitido es de 2 a 15 segundos.
  • Mensajes generados por LLM para tiempos de espera suaves: Se ha añadido la opción use_llm_generated_message a la configuración de tiempo de espera suave. Al activarla, el agente generará un mensaje contextual mediante el LLM en lugar de usar un mensaje predefinido cuando se active el tiempo de espera suave.
  • Navegación por carpetas de la base de conocimientos: Las respuestas de documentos de la base de conocimientos ahora incluyen el campo folder_path, que muestra los segmentos de la ruta desde la raíz hasta la carpeta principal, facilitando la comprensión de la jerarquía de documentos.
  • Filtrado de conversaciones por fuente de inicio: La ruta Obtener conversaciones ahora admite el filtrado mediante el parámetro de consulta conversation_initiation_source.

Doblaje

  • Nueva ruta de formato de transcripción: Se ha añadido la ruta GET /v1/dubbing/{dubbing_id}/transcripts/{language_code}/format/{format_type}, que admite los formatos de salida srt, webvtt y json. La ruta anterior GET /v1/dubbing/{dubbing_id}/transcript/{language_code} ya está obsoleta.
  • Nombre de archivo obligatorio para archivos doblados: Los modelos de archivos de la base de conocimientos ahora requieren un campo filename.

Voz a Texto

  • Detección de entidades: Se ha añadido la opción entity_detection a las solicitudes de Voz a Texto. Acepta 'all', cadenas de tipos de entidad específicos o una matriz de tipos de entidad. Las entidades detectadas se devuelven en un nuevo campo de respuesta entities mediante el esquema DetectedEntity.
  • Prompting de términos clave: Se ha añadido el parámetro de matriz keyterms a las solicitudes de Voz a Texto para orientar la transcripción hacia términos o frases específicos.

Lanzamientos de SDK

SDK de Python

  • v2.29.0 - Se han añadido la detección de entidades y el prompting de términos clave para Voz a Texto, la configuración de tiempo de espera de la cascada de LLM, la generación de mensajes por LLM para tiempos de espera suaves y la compatibilidad con zonas horarias para llamadas por lotes
  • v2.28.0 - Se han añadido campos de versionado de agentes, ID de colecciones de voz, mejoras en llamadas por lotes y etiquetas de números de teléfono

SDK de JavaScript

  • v2.30.0 - Se han añadido la detección de entidades y el prompting de términos clave para Voz a Texto, la configuración de tiempo de espera de la cascada de LLM, la generación de mensajes por LLM para tiempos de espera suaves y la compatibilidad con zonas horarias para llamadas por lotes
  • v2.29.0 - Se han añadido campos de versionado de agentes, ID de colecciones de voz, mejoras en llamadas por lotes y etiquetas de números de teléfono

Servidor MCP

  • v0.9.1 - Se ha añadido compatibilidad con Gemini Extension, corregido el manejo de rutas para output_directory no absoluto y la ausencia de base_path

API

Nuevas rutas

Rutas obsoletas

  • GET /v1/dubbing/{dubbing_id}/transcript/{language_code} - Usa en su lugar la nueva ruta específica para cada formato

Rutas actualizadas

Plataforma de agentes

Base de conocimientos

  • Listar documentos de la base de conocimientos
    • Se ha eliminado el parámetro de consulta obsoleto use_typesense
    • Se ha añadido folder_path (matriz de segmentos de ruta) a los modelos de respuesta de documentos
    • Se ha añadido filename (cadena, obligatorio) a los modelos de archivos de la base de conocimientos

Voz a Texto

  • Transcribir voz
    • Se ha añadido keyterms (matriz de cadenas, opcional) para orientar la transcripción hacia términos específicos
    • Se ha añadido entity_detection (cadena, matriz o 'all', opcional) para detectar entidades en el texto transcrito
    • Se ha añadido entities (matriz de DetectedEntity, opcional) al modelo de respuesta

Doblaje

  • Crear proyecto de doblaje
    • Se ha actualizado la descripción de mode para indicar que el modo manual es experimental y no se recomienda para uso en producción