ElevenAgents

  • Testspezifische Tool-Mocks: Agent-Simulationen und Unit-Tests können jetzt tool_mock_overrides definieren, nach Tool-ID sortiert, um gemeinsame Mocks für einen Test zu ersetzen. ToolResponseMockConfig ergänzt außerdem optional is_error (Boolean, Standardwert false), damit ein Mock Tool-Fehlerpfade testen kann.
  • Übersetzte Workflow-Nachrichten: Literale Say-Node-Nachrichten ergänzen text_translations, eine Zuordnung von Sprachschlüsseln zu TranslatedString-Objekten. Das Feld ist bei Eingaben optional und bei Ausgaben erforderlich. Strikte Antwortvalidatoren müssen es daher akzeptieren.
  • Filter für Unterhaltungsversionen: Unterhaltungen auflisten und Unterhaltungsnachrichten per Text durchsuchen ergänzen den optionalen Abfrageparameter version_id (String), um Ergebnisse nach Agent-Version zu filtern.
  • System-Tool für Wissensdatenbanken: Die Agent-Konfiguration ergänzt ein System-Tool knowledge_base mit konfigurierbaren enabled_strategies (SearchStrategy[]). RAG-Abfragen für Agent-Wissensdatenbanken ergänzen optional use_agent_defaults (Boolean, Standardwert true); setzen Sie den Wert auf false, um neutrale Retrieval-Einstellungen zu verwenden und gleichzeitig das Embedding-Modell des Agenten beizubehalten.
  • Sprachaktivitätserkennung für Agenten: Schemas für das Erstellen, Aktualisieren, Antworten und Workflow-Überschreibungen von Agenten ergänzen die vad-Konfiguration. VADConfig unterstützt derzeit background_voice_detection (Boolean, Standardwert false).
  • WebSocket-benutzerdefinierte LLMs: CustomLLMAPIType ergänzt websocket.
  • Steuerung des Dateispeichers: Die Konfiguration für Widget-Dateieingaben ergänzt max_files_in_memory (Integer, 1–30, Standardwert 10). Dateien über diesem Limit werden zusammengefasst und aus dem Speicher freigegeben; max_files_per_conversation muss -1 sein oder mindestens dem Speicherlimit entsprechen.
  • Schwärzung von DTMF-Eingaben: DTMFInputConfig ergänzt optional redact_input (Boolean, Standardwert false), um Ziffern der Anrufer-Tastatur in Transkripten, Unterhaltungsprotokollen und Analysen zu ersetzen. Vom Agenten wiederholte oder an Tools übergebene Ziffern bleiben unverändert.

Speech to Text

  • Echtzeit-Entitätserkennung: Scribe v2 Realtime ergänzt die Abfrageoption entity_detection. Sie akzeptiert all, einen Entitätstyp oder eine Kategorie oder ein Array von Typen und Kategorien und gibt erkannte Entitäten in Ereignissen vom Typ committed_transcript_entities aus. Unterstützte Kategorien finden Sie im Leitfaden zur Entitätserkennung.

Stimmen

  • Stimmreplikation über Datenresidenzen hinweg: POST /v1/voices/{voice_id}/replicate-to-isolated-environment hinzugefügt, um eine Instant Voice Clone- oder Voice Design-Stimme in einen Workspace derselben konsolidierten Abrechnungsgruppe zu kopieren. Anfragen erfordern target_workspace_id (String) und akzeptieren preserve_voice_id (Boolean, Standardwert true); Antworten geben die Ziel-voice_id zurück.
  • Charaktermetadaten: Charakterantworten ergänzen recommended_voice_ids (String-Array, Standardwert []), Metadaten ergänzen nullable role (CharacterRole) und CharacterAge ersetzt middle-aged durch middle_aged.

SDK-Releases

Pakete

MCP-Server

  • v0.12.1 - Enthält die Tool-Updates aus v0.11 und eine Aktualisierung der Abhängigkeiten, die 44 Sicherheitswarnungen behebt.
  • v0.11.0 - simulate_conversation mit konfigurierbarem Verhalten simulierter Nutzer, Evaluierungskriterien, Transkriptausgabe und Bestanden-/Nichtbestanden-Analyse hinzugefügt. Das Tool speech_to_text verwendet jetzt standardmäßig scribe_v2, und voice_clone sendet jetzt Audiodateiinhalte statt Pfad-Strings.

API

Neue Endpunkte

Stimmen

  • POST /v1/voices/{voice_id}/replicate-to-isolated-environment
    • Repliziert eine Instant Voice Clone- oder Voice Design-Stimme in die isolierte Umgebung eines anderen Workspaces
    • Erfordert target_workspace_id (String)
    • Akzeptiert optional preserve_voice_id (Boolean, Standardwert true)
    • Gibt die erforderliche voice_id (String) zurück

Aktualisierte Endpunkte

ElevenAgents

  • Unterhaltungen auflisten - GET /v1/convai/conversations
    • Optionalen Abfrageparameter version_id (String) hinzugefügt
  • Unterhaltungsnachrichten per Text durchsuchen - GET /v1/convai/conversations/messages/text-search
    • Optionalen Abfrageparameter version_id (String) hinzugefügt
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • Optionales Anfragefeld use_agent_defaults (Boolean, Standardwert true) hinzugefügt

Schemaänderungen

ElevenAgents

  • Nutzlasten für Simulationen und Unit-Tests ergänzen optionale tool_mock_overrides-Zuordnungen; ToolResponseMockConfig ergänzt optional is_error (Boolean, Standardwert false)
  • SayNodeLiteralMessage ergänzt text_translations (Zuordnung von TranslatedString); das Feld ist bei Eingaben optional und bei Ausgaben erforderlich
  • Die Agent-Konfiguration ergänzt knowledge_base (KnowledgeBaseToolConfig) und vad (VADConfig)
  • CustomLLMAPIType ergänzt websocket
  • FileInputConfig ergänzt max_files_in_memory (Integer, 1–30, Standardwert 10)
  • DTMFInputConfig ergänzt optional redact_input (Boolean, Standardwert false)
  • Die Echtzeit-Agent-Konfiguration verwendet jetzt standardmäßig eleven_realtime_v1_mini

Stimmen

  • Charakterantworten ergänzen recommended_voice_ids (String-Array, Standardwert [])
  • Charaktermetadaten ergänzen nullable role (CharacterRole)
  • Nicht abwärtskompatibel: CharacterAge ersetzt middle-aged durch middle_aged; Clients, die den alten Wert senden, müssen migriert werden

Text to Speech

  • Nicht abwärtskompatibel: AudioFilterId und audio_filter wurden aus den Text to Speech-Konfigurationsschemas von ElevenAgents entfernt