Scribe v2 Realtime

Scribe v2 Realtime, unser schnellstes und präzisestes Modell für Live-Spracherkennung, ist offiziell verfügbar. Es bietet in über 92 Sprachen modernste Genauigkeit bei extrem niedrigen 150 ms Latenz. Mehr erfahren.

Agents-Plattform

  • Feedback im Widget nach Gesprächsende: Widgets unterstützen jetzt anpassbares Feedback nach Gesprächsende mit optionalen Bewertungs- und Kommentarfeldern. So können Sie Nutzerfeedback direkt in Ihren Agent-Gesprächen erfassen.
  • Konfiguration von Soft-Timeouts: Umfassende Soft-Timeout-Einstellungen steuern jetzt, wie Agents Gesprächspausen handhaben. Prompts und Verhalten lassen sich auf Turn- und Gesprächsebene konfigurieren.
  • Erweiterte Gesprächsfilterung: Der Endpunkt für Gespräche unterstützt jetzt Filter nach Anrufdauerbereich, Bewertungsparametern, Datenerfassungsparametern und bestimmten Tool-Namen.
  • Verbessertes Gesprächsfeedback: Das System für Gesprächsfeedback wurde um strukturierte Feedback-Typen wie Bewertungen und Kommentare erweitert, um die Nutzererfahrung besser nachzuverfolgen.

ElevenCreative Studio

  • Erweiterte Projektmetadaten: Projekte enthalten jetzt umfassendes Asset-Tracking mit Video-Thumbnails, externen Audio-Referenzen und erweiterten Snapshot-Informationen, einschließlich Audiodauer.

Abrechnung

  • Erweiterte Rechnungsdetails: Rechnungsantworten enthalten jetzt detaillierte Rabattinformationen mit einem neuen discounts-Array, das die veralteten Felder discount_percent_off und discount_amount_off ersetzt. Die Felder subtotal_cents und tax_cents bieten eine klarere Rechnungsaufschlüsselung.

Music API

  • Verbesserte Latenz bei Stem-Separation: Der Endpunkt für Stem-Separation wurde aktualisiert, um Audiodateien besser zu verarbeiten und besser vorhersehbare Latenzen für Verarbeitungsanfragen zu bieten.

SDK-Versionen

JavaScript SDK

  • v2.23.0 - Speech-to-Text-Endpunkt (Scribe) auf scribe_realtime aktualisiert und zusätzliche TypeScript-Typen für eine bessere Entwicklererfahrung exportiert.
  • v2.22.0 - Mit den neuesten API-Schemaänderungen aktualisiert, einschließlich Gesprächsfilterung, Soft-Timeout-Konfiguration und Widget-Feedback-Funktionen.

Python SDK

  • v2.22.1 - Speech-to-Text-Endpunkt (Scribe) auf scribe_realtime aktualisiert und Probleme mit zirkulären Imports für mehr Stabilität behoben.
  • v2.22.0 - Mit den neuesten API-Schemaänderungen aktualisiert, einschließlich Gesprächsfilterung, Soft-Timeout-Konfiguration und Widget-Feedback-Funktionen.

Agents-Pakete

Android SDK

  • v0.5.0 - Funktionen setVolume und getVolume zur programmgesteuerten Audiosteuerung hinzugefügt, mit einer Beispielimplementierung einschließlich Lautstärke-Schieberegler in der Beispiel-App.

API

Aktualisierte Endpunkte

Agents-Plattform

Gesprächsverwaltung

  • Gespräche abrufen

    • Abfrageparameter call_duration_min_secs (integer) hinzugefügt, um Gespräche nach Mindestanrufdauer zu filtern
    • Abfrageparameter call_duration_max_secs (integer) hinzugefügt, um Gespräche nach maximaler Anrufdauer zu filtern
    • Abfrageparameter evaluation_params (Array von Strings) zum Filtern nach Bewertungskriterien hinzugefügt
    • Abfrageparameter data_collection_params (Array von Strings) zum Filtern nach Datenerfassungsparametern hinzugefügt
    • Abfrageparameter tool_names (Array von Strings) hinzugefügt, um Gespräche zu filtern, die bestimmte Tools verwendet haben
  • Gesprächsfeedback geben

    • Verwendet jetzt ConversationFeedbackRequestModel mit strukturierten Feedback-Typen
    • Feld type zur Angabe der Feedback-Kategorie hinzugefügt
    • Feld rating für numerisches Feedback hinzugefügt
    • Feld comment für Textfeedback hinzugefügt

Agent-Konfiguration

  • Agent-Widget abrufen
    • Feld end_feedback mit WidgetEndFeedbackConfig zur Konfiguration der Feedback-Erfassung nach Gesprächsende hinzugefügt
    • Unterstützt optionale Bewertungs- und Kommentarfelder in Feedback-Formularen
  • Agent abrufen & Agent aktualisieren
    • Antwortschema aktualisiert, um neue Optionen für die Plattformkonfiguration einzuschließen
    • Anfrageschema um zusätzliche Einstellungsfelder erweitert

Turn- und Gesprächskonfiguration

  • Agent erstellen, Gespräch simulieren, Gesprächsstream simulieren

    • Feld soft_timeout_config zur Steuerung des Pausenverhaltens während Gesprächen hinzugefügt
    • Konfigurationsüberschreibungen für turn über TurnConfigOverride und TurnConfigOverrideConfig hinzugefügt
    • initial_wait_time zu TurnConfig hinzugefügt, um das Timing der ersten Antwort zu steuern
    • Konfiguration auf Gesprächs- und Workflow-Override-Ebene verfügbar

Tests

  • Agent-Tests ausführen

    • Anfrageschema für Unterstützung von Workflow-Ausdrücken erweitert
    • Antwortschema um zusätzliche Testresultatfelder aktualisiert
  • Testaufruf abrufen

    • Antwort enthält erweiterte Testresultatdaten
    • Schema für Ergebnisse von Workflow-Ausdrücken aktualisiert

ElevenCreative Studio

  • Projekt abrufen

    • Feld assets (erforderlich) mit Videos und externen Audio-Referenzen hinzugefügt
    • ProjectVideoResponseModel für Metadaten von Video-Assets eingeführt
    • ProjectExternalAudioResponseModel für externes Audio-Tracking eingeführt
    • ProjectVideoThumbnailSheetResponseModel für Video-Thumbnails eingeführt
  • Projekt-Snapshot abrufen

    • Antwort mit neuem ProjectSnapshotExtendedResponseModel umstrukturiert
    • Feld audio_duration_secs (erforderlich) zu Snapshot-Daten hinzugefügt
    • character_alignments aus ProjectSnapshotResponseModel entfernt
    • ProjectSnapshotsResponseModel für Snapshot-Sammlungen eingeführt

Abrechnung

  • Abonnement abrufen
    • Array discounts (erforderlich) mit Einträgen von DiscountResponseModel hinzugefügt
    • Feld discount_percent_off als veraltet markiert (weiterhin verfügbar, aber zur Entfernung vorgesehen)
    • Feld discount_amount_off als veraltet markiert (weiterhin verfügbar, aber zur Entfernung vorgesehen)
    • Feld subtotal_cents (integer, nullable) für Rechnungssummen vor Steuern hinzugefügt
    • Feld tax_cents (integer, nullable) für Steuerbeträge hinzugefügt
    • Rechnungsbeispiele aktualisiert, um neue Rabatt- und Summenfelder einzuschließen

Speech to Text

Text to Speech

Stimmenverwaltung

Professional Voice Cloning (PVC)

Sprachvoreinstellungen

  • Sprachvoreinstellungsmodelle enthalten jetzt das Feld soft_timeout_translation für lokalisierte Soft-Timeout-Nachrichten

API-Integrationstrigger

  • Neue API-Sammlung registriert: convai_api_integration_trigger_connections

Veraltete Funktionen

  • Die Rechnungsfelder discount_percent_off und discount_amount_off sind veraltet; verwenden Sie stattdessen das Array discounts