Scribe v2 Realtime
Scribe v2 Realtime, unser schnellstes und präzisestes Modell für Live-Spracherkennung, ist offiziell verfügbar. Es bietet in über 92 Sprachen modernste Genauigkeit bei extrem niedrigen 150 ms Latenz. Mehr erfahren.
Agents-Plattform
- Feedback im Widget nach Gesprächsende: Widgets unterstützen jetzt anpassbares Feedback nach Gesprächsende mit optionalen Bewertungs- und Kommentarfeldern. So können Sie Nutzerfeedback direkt in Ihren Agent-Gesprächen erfassen.
- Konfiguration von Soft-Timeouts: Umfassende Soft-Timeout-Einstellungen steuern jetzt, wie Agents Gesprächspausen handhaben. Prompts und Verhalten lassen sich auf Turn- und Gesprächsebene konfigurieren.
- Erweiterte Gesprächsfilterung: Der Endpunkt für Gespräche unterstützt jetzt Filter nach Anrufdauerbereich, Bewertungsparametern, Datenerfassungsparametern und bestimmten Tool-Namen.
- Verbessertes Gesprächsfeedback: Das System für Gesprächsfeedback wurde um strukturierte Feedback-Typen wie Bewertungen und Kommentare erweitert, um die Nutzererfahrung besser nachzuverfolgen.
ElevenCreative Studio
- Erweiterte Projektmetadaten: Projekte enthalten jetzt umfassendes Asset-Tracking mit Video-Thumbnails, externen Audio-Referenzen und erweiterten Snapshot-Informationen, einschließlich Audiodauer.
Abrechnung
- Erweiterte Rechnungsdetails: Rechnungsantworten enthalten jetzt detaillierte Rabattinformationen mit einem neuen
discounts-Array, das die veralteten Felderdiscount_percent_offunddiscount_amount_offersetzt. Die Feldersubtotal_centsundtax_centsbieten eine klarere Rechnungsaufschlüsselung.
Music API
- Verbesserte Latenz bei Stem-Separation: Der Endpunkt für Stem-Separation wurde aktualisiert, um Audiodateien besser zu verarbeiten und besser vorhersehbare Latenzen für Verarbeitungsanfragen zu bieten.
SDK-Versionen
JavaScript SDK
- v2.23.0 - Speech-to-Text-Endpunkt (Scribe) auf
scribe_realtimeaktualisiert und zusätzliche TypeScript-Typen für eine bessere Entwicklererfahrung exportiert. - v2.22.0 - Mit den neuesten API-Schemaänderungen aktualisiert, einschließlich Gesprächsfilterung, Soft-Timeout-Konfiguration und Widget-Feedback-Funktionen.
Python SDK
- v2.22.1 - Speech-to-Text-Endpunkt (Scribe) auf
scribe_realtimeaktualisiert und Probleme mit zirkulären Imports für mehr Stabilität behoben. - v2.22.0 - Mit den neuesten API-Schemaänderungen aktualisiert, einschließlich Gesprächsfilterung, Soft-Timeout-Konfiguration und Widget-Feedback-Funktionen.
Agents-Pakete
- @elevenlabs/client@0.10.0 - Konfiguration des Echtzeit-Endpunkts aktualisiert und Dokumentation verbessert.
- @elevenlabs/react@0.10.0 - Konfiguration des Echtzeit-Endpunkts aktualisiert und Dokumentation verbessert.
- @elevenlabs/types@0.2.0 - Typdefinitionen an die neuesten API-Schemaänderungen angepasst.
- @elevenlabs/react@0.9.2 - Kleinere Fehlerbehebungen und Stabilitätsverbesserungen.
- @elevenlabs/convai-widget-embed@0.5.1 - Widget-Einbettungsfunktion mit Unterstützung für Feedback nach Gesprächsende aktualisiert.
- @elevenlabs/convai-widget-core@0.5.1 - Konfiguration für Feedback nach Gesprächsende zum Widget-Core hinzugefügt.
- @elevenlabs/convai-widget-embed@0.5.0 - Unterstützung für die anpassbare Erfassung von Feedback nach Gesprächsende hinzugefügt.
- @elevenlabs/convai-widget-core@0.5.0 -
WidgetEndFeedbackConfigundWidgetEndFeedbackTypefür die Feedback-Verarbeitung eingeführt. - @elevenlabs/client@0.9.2 - Client-Konfiguration mit den neuesten API-Änderungen aktualisiert.
Android SDK
- v0.5.0 - Funktionen
setVolumeundgetVolumezur programmgesteuerten Audiosteuerung hinzugefügt, mit einer Beispielimplementierung einschließlich Lautstärke-Schieberegler in der Beispiel-App.
API
API-Änderungen anzeigen
Aktualisierte Endpunkte
Agents-Plattform
Gesprächsverwaltung
-
- Abfrageparameter
call_duration_min_secs(integer) hinzugefügt, um Gespräche nach Mindestanrufdauer zu filtern - Abfrageparameter
call_duration_max_secs(integer) hinzugefügt, um Gespräche nach maximaler Anrufdauer zu filtern - Abfrageparameter
evaluation_params(Array von Strings) zum Filtern nach Bewertungskriterien hinzugefügt - Abfrageparameter
data_collection_params(Array von Strings) zum Filtern nach Datenerfassungsparametern hinzugefügt - Abfrageparameter
tool_names(Array von Strings) hinzugefügt, um Gespräche zu filtern, die bestimmte Tools verwendet haben
- Abfrageparameter
-
- Verwendet jetzt
ConversationFeedbackRequestModelmit strukturierten Feedback-Typen - Feld
typezur Angabe der Feedback-Kategorie hinzugefügt - Feld
ratingfür numerisches Feedback hinzugefügt - Feld
commentfür Textfeedback hinzugefügt
- Verwendet jetzt
Agent-Konfiguration
- Agent-Widget abrufen
- Feld
end_feedbackmitWidgetEndFeedbackConfigzur Konfiguration der Feedback-Erfassung nach Gesprächsende hinzugefügt - Unterstützt optionale Bewertungs- und Kommentarfelder in Feedback-Formularen
- Feld
- Agent abrufen & Agent aktualisieren
- Antwortschema aktualisiert, um neue Optionen für die Plattformkonfiguration einzuschließen
- Anfrageschema um zusätzliche Einstellungsfelder erweitert
Turn- und Gesprächskonfiguration
-
Agent erstellen, Gespräch simulieren, Gesprächsstream simulieren
- Feld
soft_timeout_configzur Steuerung des Pausenverhaltens während Gesprächen hinzugefügt - Konfigurationsüberschreibungen für
turnüberTurnConfigOverrideundTurnConfigOverrideConfighinzugefügt initial_wait_timezuTurnConfighinzugefügt, um das Timing der ersten Antwort zu steuern- Konfiguration auf Gesprächs- und Workflow-Override-Ebene verfügbar
- Feld
Tests
-
- Anfrageschema für Unterstützung von Workflow-Ausdrücken erweitert
- Antwortschema um zusätzliche Testresultatfelder aktualisiert
-
- Antwort enthält erweiterte Testresultatdaten
- Schema für Ergebnisse von Workflow-Ausdrücken aktualisiert
ElevenCreative Studio
-
- Feld
assets(erforderlich) mit Videos und externen Audio-Referenzen hinzugefügt ProjectVideoResponseModelfür Metadaten von Video-Assets eingeführtProjectExternalAudioResponseModelfür externes Audio-Tracking eingeführtProjectVideoThumbnailSheetResponseModelfür Video-Thumbnails eingeführt
- Feld
-
- Antwort mit neuem
ProjectSnapshotExtendedResponseModelumstrukturiert - Feld
audio_duration_secs(erforderlich) zu Snapshot-Daten hinzugefügt character_alignmentsausProjectSnapshotResponseModelentferntProjectSnapshotsResponseModelfür Snapshot-Sammlungen eingeführt
- Antwort mit neuem
Abrechnung
- Abonnement abrufen
- Array
discounts(erforderlich) mit Einträgen vonDiscountResponseModelhinzugefügt - Feld
discount_percent_offals veraltet markiert (weiterhin verfügbar, aber zur Entfernung vorgesehen) - Feld
discount_amount_offals veraltet markiert (weiterhin verfügbar, aber zur Entfernung vorgesehen) - Feld
subtotal_cents(integer, nullable) für Rechnungssummen vor Steuern hinzugefügt - Feld
tax_cents(integer, nullable) für Steuerbeträge hinzugefügt - Rechnungsbeispiele aktualisiert, um neue Rabatt- und Summenfelder einzuschließen
- Array
Speech to Text
- Audio transkribieren
- Antwortschema mit erweiterten Transkriptionsdaten aktualisiert
Text to Speech
-
Text mit Zeitstempeln in Sprache umwandeln & Text mit Zeitstempeln als Stream in Sprache umwandeln
- Antwortschema mit erweiterten Zeitstempeldaten aktualisiert
-
Dialog mit Zeitstempeln in Sprache umwandeln & Dialog mit Zeitstempeln als Stream in Sprache umwandeln
- Antwortschema mit erweiterten Zeitstempel- und Sprachsegmentdaten aktualisiert
Stimmenverwaltung
-
Stimme abrufen, Stimmeinstellungen abrufen, Standard-Stimmeinstellungen abrufen
- Antwortschemas mit neuen Metadaten- und Konfigurationsfeldern für Stimmen aktualisiert
-
- Anfrageschema zur Änderung von Stimmeinstellungen aktualisiert
-
- Antwortschema mit neuen Daten zur Stimmgenerierung aktualisiert
Professional Voice Cloning (PVC)
- PVC-Beispielaudio abrufen & Audio mit separierter Sprecherstimme abrufen
- Antwortschemas für den Abruf von Audiobeispielen aktualisiert
Sprachvoreinstellungen
- Sprachvoreinstellungsmodelle enthalten jetzt das Feld
soft_timeout_translationfür lokalisierte Soft-Timeout-Nachrichten
API-Integrationstrigger
- Neue API-Sammlung registriert:
convai_api_integration_trigger_connections
Veraltete Funktionen
- Die Rechnungsfelder
discount_percent_offunddiscount_amount_offsind veraltet; verwenden Sie stattdessen das Arraydiscounts