ElevenAgents

  • Parallele Tool-Aufrufe: Die Agent-Prompt-Konfiguration enthält jetzt enable_parallel_tool_calls (Boolean, Standardwert true). Wenn aktiviert, können unterstützte Modelle mehrere Tools in einem Zug ausführen.
  • Agent-Modelle: gpt-6-astra zu den Agent-LLM-Optionen hinzugefügt.
  • Benachrichtigungen: Agent-Benachrichtigungen unterstützen jetzt neben PagerDuty und Webhook-Benachrichtigern auch Slack-Kanäle.
  • Telefonnummernsuche: Einen cursor-paginierten Telefonnummern-Endpunkt mit Filtern für Anbieter, Unterstützung für ausgehende Anrufe, zugewiesenen Agent und Branch, Label und Telefonnummer hinzugefügt.

Bild und Video

  • GPT Image 2.5-Modelle: Bildgenerierung unterstützt jetzt gpt-image-2.5-flare und gpt-image-2.5-sunburst. Beide Modelle akzeptieren bis zu 10 Referenzbilder, Qualitätsstufen bis max, 14 feste Seitenverhältnisse sowie auto und eine Ausgabe in 1K, 2K oder 4K.

Speech Engine

  • Cascade-Timeout: Anfragen zum Erstellen und Aktualisieren der Speech Engine akzeptieren jetzt cascade_timeout_seconds (Zahl, 2–15, Standardwert 4), um zu steuern, wie lange ElevenLabs vor einem erneuten Versuch auf eine übergeordnete Speech Engine wartet.

Text to Speech

  • Turn-Grenzen mit mehreren Kontexten: Der Marker is_final_audio_for_turn wird jetzt nach jedem gepufferten Byte für diesen Turn ausgegeben, einschließlich MP3- und Opus-Ausgabe. Clients können den Marker als exakte Turn-Grenze verwenden, ohne zu PCM wechseln zu müssen.

SDK-Releases

JavaScript SDK

  • v2.69.0 - transcriptEdit zum Echtzeit-Speech-to-Text-Wrapper hinzugefügt; bearbeiteter Text wird über edited_transcript-Ereignisse bereitgestellt. JWT-Verifizierung der Speech Engine für API-Keys mit Data-Residency-Suffixen behoben. phoneNumbers.listV2 und Flows-Template-Methoden zum Auflisten und Abrufen von Templates sowie zum Auflisten, Erstellen und Abrufen von Ausführungen hinzugefügt. Clients und Typen für GPT Image 2.5, Slack-Agent-Benachrichtigungen, parallele Tool-Aufrufe, gpt-6-astra, Parallelitätslimits für API-Keys von Servicekonten, Music Zero Retention, Gesprächsfilter und MCP-Tool-Genehmigungsstatus neu generiert.

Python SDK

  • v2.69.0 - transcript_edit zum Echtzeit-Speech-to-Text-Wrapper hinzugefügt; bearbeiteter Text wird über edited_transcript-Ereignisse bereitgestellt. JWT-Verifizierung der Speech Engine für API-Keys mit Data-Residency-Suffixen behoben und play löst jetzt einen Fehler aus, wenn ffplay fehlschlägt. phone_numbers.list_v2 und Flows-Template-Methoden zum Auflisten und Abrufen von Templates sowie zum Auflisten, Erstellen und Abrufen von Ausführungen hinzugefügt. Clients und Typen für GPT Image 2.5, Slack-Agent-Benachrichtigungen, parallele Tool-Aufrufe, gpt-6-astra, Parallelitätslimits für API-Keys von Servicekonten, Music Zero Retention, Gesprächsfilter und MCP-Tool-Genehmigungsstatus neu generiert.

ElevenLabs CLI

  • v1.3.2 - Optionale --intent-Metadaten hinzugefügt, um Feedback zur CLI-Nutzung zu sammeln. elevenlabs feedback missing-capability hinzugefügt, um Workflows zu melden, die die CLI nicht unterstützt.

API

Neue Endpunkte

ElevenAgents

  • Telefonnummernseite auflisten - GET /v1/convai/v2/phone-numbers
    • Optionale Paginierungsparameter page_size (Ganzzahl, 1–1.000, Standardwert 100) und cursor (nullable String) hinzugefügt.
    • Optionale Filter search, label, phone_number, provider, supports_outbound, agent_id, branch_id, sort_by und sort_direction hinzugefügt. sort_by akzeptiert label oder phone_number; sort_direction hat standardmäßig den Wert asc.
    • Die Antwort enthält die erforderlichen phone_numbers (Array), optional nullable next_cursor (String) und has_more (Boolean, Standardwert false).

Aktualisierte Endpunkte

ElevenAgents

  • Agent erstellen, Agent abrufen und Agent aktualisieren
    • Die Prompt-Konfiguration enthält zusätzlich enable_parallel_tool_calls (Boolean, Standardwert true). Workflow-Überschreibungen akzeptieren einen nullable Boolean.
    • Die Aufzählung LLM enthält zusätzlich gpt-6-astra, einschließlich Überschreibungen für die Gesprächsinitiierung.
    • Benachrichtiger für Alerting-Integrationen verwenden jetzt integration_type, um pagerduty oder slack auszuwählen. Slack-Benachrichtiger erfordern connection_id und channel_id (Strings); channel_id akzeptiert 1–64 Zeichen.
  • Unterhaltungen auflisten und Unterhaltungsreferenz auflösen
    • data_collection_params akzeptiert den Operator missing nicht mehr. Verwenden Sie einen leeren Wert, um Unterhaltungen abzugleichen, bei denen das Feld nicht erfasst wurde.
    • Ein leerer Wert in dynamic_variable_params gleicht Unterhaltungen ab, bei denen die Variable nicht gesetzt wurde.
  • Speech Engine erstellen, Speech Engine abrufen und Speech Engine aktualisieren
    • cascade_timeout_seconds (Zahl, 2–15) hinzugefügt. Erstellungsanfragen haben standardmäßig den Wert 4, Aktualisierungsanfragen akzeptieren einen nullable Wert und Antworten erfordern das Feld.

Bild und Video

  • Bildgenerierung erstellen - POST /v1/flows/image
    • Anfragevarianten für gpt-image-2.5-flare und gpt-image-2.5-sunburst hinzugefügt.
    • Beide Varianten erfordern prompt und model_id, akzeptieren bis zu 10 images und enthalten zusätzlich resolution (1K, 2K oder 4K, Standardwert 1K).
    • quality akzeptiert low, medium, high, xhigh oder max und hat standardmäßig den Wert high. aspect_ratio akzeptiert auto und 14 feste Verhältnisse und hat standardmäßig den Wert 16:9.

Synchronisation

Wissensdatenbank

  • Crawl-Job erstellen - POST /v1/convai/knowledge-base/crawl
    • max_depth (Ganzzahl, Standardwert 3) als veraltet markiert. Das Feld hat jetzt keine Wirkung mehr und unterliegt keinen Mindest- oder Höchstgrenzen.
    • Metadaten des Crawl-Jobs erfordern max_depth nicht mehr.

Benutzer

Schemaänderungen

Text to Speech

  • WebSocket-Nachrichten audio und final mit mehreren Kontexten definieren is_final_audio_for_turn jetzt als nach der Übermittlung aller gepufferten Bytes für den Turn auftretend.