Presentazione di Music v2
Music v2 è ora disponibile tramite l’API ElevenLabs. Imposta model_id su music_v2 in Genera musica, Trasmetti musica, Genera musica dettagliata e Carica musica per usare il nuovo modello. Music v2 introduce piani di composizione basati su chunk, creati da segmenti GenerationChunk e AudioRefChunk, offrendoti un controllo più preciso su struttura, ritmo e arrangiamento rispetto al flusso music_v1 basato su prompt.
Usa i piani di composizione music_v2 nelle richieste di generazione e caricamento, oppure genera prima un piano tramite l’endpoint dei piani di composizione. I body delle richieste e delle risposte accettano formati di piano v1 o v2, così puoi eseguire la migrazione endpoint per endpoint. MusicPrompt rimane disponibile solo per music_v1.
- Timestamp di caricamento: Carica musica accetta
with_timestampsfacoltativo; le risposte possono includerewords_timestamps.
ElevenAgents
- Esegui valutazione della conversazione: aggiunto l’endpoint Esegui valutazione della conversazione (
POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run) per rieseguire un singolo criterio di valutazione su una conversazione completata usandoRunConversationEvaluationsRequest. - Comportamento di ingresso nel workflow: i nodi del workflow che sovrascrivono l’agente aggiungono
entry_behaviorfacoltativo (generate_immediately,wait_for_user,auto) per controllare se il sottoagente parla per primo o attende l’input dell’utente. - Strumento di sistema per terminare la procedura: aggiunta la configurazione dello strumento di sistema
end_procedurecon stati di errore corrispondenti. Lo strumentostart_procedureaggiungealready_activeai propri stati di errore. - Override TTS per trasferimento:
AgentTransfer, i nodi agente autonomi del workflow e i risultati riusciti dello strumentotransfer_to_agentaggiungonopreserve_client_tts_overridesfacoltativo (booleano) per mantenere gli override TTS lato client dopo un trasferimento. - Enum del budget di interazione:
InteractionBudgetrimuoveasynce aggiunge5_minutes,10_minutese1_hour. Aggiorna tutte le configurazioni o gli enum SDK che fanno ancora riferimento aasync. - Selezione del modello di guardrail personalizzato: la configurazione dei guardrail personalizzati aggiunge
modelfacoltativo con varianti Gemini, Claude e GPT. La configurazione dei guardrail aggiunge anchehistory_message_countfacoltativo (intero). - Filtri dell’elenco di numeri telefonici: Elenca numeri telefonici aggiunge i parametri query facoltativi
provider,agent_idebranch_idper filtrare i numeri importati. - Filtraggio degli account WhatsApp: Elenca account WhatsApp aggiunge il parametro query facoltativo
agent_idper filtrare gli account in base all’agente assegnato. - Filtri per intervallo temporale degli argomenti: Ottieni argomenti delle conversazioni dell’agente aggiunge i parametri query facoltativi
from_unix_secseto_unix_secsper delimitare i risultati del rilevamento degli argomenti. - Configurazione dei codec SIP: i modelli di richiesta e risposta dei trunk SIP in uscita aggiungono
enabled_codecsfacoltativo (enumMediaCodec). - Tipi di strumenti per la memoria: aggiunti gli schemi
LoadableMemoryEntryeLoadMemoryEntryToolErrorStatusper la gestione degli errori degli strumenti per la memoria. - Limiti per batch di test degli agenti: gli schemi delle richieste di collegamento, esecuzione e reinvio dei test degli agenti aumentano il massimo di test collegati da 1000 a 5000.
- Supporto dei tag fonema: le impostazioni TTS degli agenti aggiungono
enable_phoneme_tagsfacoltativo (booleano) per la gestione opzionale dei fonemi SSML V3. - Override di omissione dello schema degli array: le proprietà dello schema JSON degli array aggiungono
is_omittedfacoltativo (mutuamente esclusivo con altre origini di valore).ConstantSchemaOverridepuò usare valori costanti di tipo array. - Contesto degli errori di trasferimento: i payload di errore del trasferimento a un numero possono includere
agent_messagefacoltativo (stringa).
Workspace
- Aggiornamenti delle chiavi API degli account di servizio: Aggiorna chiave API dell’account di servizio non richiede più un body della richiesta. I campi modificabili supportano aggiornamenti parziali tramite
no_updateenamenullable, inclusipermissionsecharacter_limit. - Raggruppamento per fuso orario dell’utilizzo: le richieste di utilizzo del workspace per prodotto nel tempo aggiungono
time_zonefacoltativo (stringa di fuso orario IANA) con regole chiarite per i bucketinterval_seconds. - Filtro dell’origine della cronologia: i filtri
sourceper l’elenco e i dettagli della cronologia aggiungonoFlows.
ElevenCreative Studio
- Riferimenti vocali del progetto: i modelli dei progetti, i nodi TTS dei capitoli, gli elenchi vocali e le statistiche vocali passano a
project_voice_ref_idcome campo vocale canonico. I precedenti campivoice_idrestano nelle risposte come mirror di sola lettura deprecati per compatibilità.
Speech to Text
- Diarizzazione della libreria di speaker: Converti parlato in testo aggiunge
use_speaker_libraryfacoltativo (booleano, valore predefinitofalse) per la diarizzazione delle trascrizioni batch.
Voci
- Ordinamento delle voci condivise: il parametro query
sortdi Elenca voci condivise ottiene un enum esplicito, il valore predefinitocreated_datee una descrizione aggiornata.
Release SDK
SDK JavaScript
- v2.53.0 - Rigenerato dallo schema OpenAPI più recente con supporto per la riesecuzione della valutazione delle conversazioni, union dei piani di composizione Music v2,
entry_behaviordel workflow, filtri per elenchi di numeri telefonici e WhatsApp, parametri per intervalli temporali degli argomenti, aggiornamenti dello schema di avviso, campiproject_voice_ref_iddi Studio e limiti ampliati per i batch di test degli agenti.
SDK Python
- v2.53.0 - Rigenerato dallo schema OpenAPI più recente con supporto per la riesecuzione della valutazione delle conversazioni, piani di composizione Music v2, comportamento di ingresso del workflow e strumenti per terminare le procedure, parametri di filtro per la telefonia, modelli di aggiornamento parziale per avvisi e account di servizio e campi di riferimento vocale di Studio.
Pacchetti
- @elevenlabs/client@1.11.0 - Aggiunta l’esportazione del sottopath
@elevenlabs/client/internal/unityper il bridge WebGL dell’SDK Unity, che esponeMediaDeviceInput,MediaDeviceOutput, helper per il collegamento delle connessioni e tipi di adattatore WebRTC. - @elevenlabs/client@1.11.1, @elevenlabs/react@1.6.7, @elevenlabs/react-native@1.2.7, @elevenlabs/convai-widget-core@0.14.2 e @elevenlabs/convai-widget-embed@0.14.2 - Allineamento delle dipendenze a
@elevenlabs/client@1.11.1e@elevenlabs/types@0.14.1. - @elevenlabs/types@0.14.1 - Aggiunto
"license": "MIT"apackage.jsonper la compatibilità con license-checker.
SDK iOS
- v3.2.1 - Aggiunto il supporto per la residenza dei dati a Singapore e abilitato
singlePeerConnectionper le sessioni WebRTC.
API
Visualizza modifiche API
Nuovi endpoint
ElevenAgents
- Esegui valutazione della conversazione -
POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run- Il body della richiesta usa
RunConversationEvaluationsRequestper rieseguire un singolo criterio di valutazione
- Il body della richiesta usa
Endpoint aggiornati
ElevenAgents
- Elenca numeri telefonici -
GET /v1/convai/phone-numbers- Aggiunti i parametri query facoltativi
provider,agent_idebranch_id
- Aggiunti i parametri query facoltativi
- Ottieni argomenti delle conversazioni dell’agente -
GET /v1/convai/agents/{agent_id}/topics- Aggiunti i parametri query facoltativi
from_unix_secseto_unix_secs
- Aggiunti i parametri query facoltativi
- Elenca account WhatsApp -
GET /v1/convai/whatsapp-accounts- Aggiunto il parametro query facoltativo
agent_id
- Aggiunto il parametro query facoltativo
Musica
- Genera musica, Genera musica dettagliata, Trasmetti musica e Carica musica
- Aggiunto
music_v2ai valorimodel_idsupportati - Il caricamento aggiunge
with_timestampsfacoltativo; le risposte possono includerewords_timestamps
- Aggiunto
Speech to Text
- Converti parlato in testo -
POST /v1/speech-to-text- Aggiunto il parametro query facoltativo
use_speaker_library(booleano, valore predefinitofalse)
- Aggiunto il parametro query facoltativo
Voci
- Elenca voci condivise -
GET /v1/shared-voices- Il parametro query
sortora usa un enum esplicito con valore predefinitocreated_date
- Il parametro query
Modifiche agli schemi
ElevenAgents
- Nodi del workflow che sovrascrivono l’agente
- Aggiunto enum
entry_behaviorfacoltativo (generate_immediately,wait_for_user,auto)
- Aggiunto enum
- Strumenti di sistema
- Aggiunta configurazione dello strumento
end_proceduree relativi stati di errore
- Aggiunta configurazione dello strumento
- Schemi di trasferimento e interazione
- Aggiunto
preserve_client_tts_overridesfacoltativo nei trasferimenti e nei risultati degli strumenti di trasferimento InteractionBudgetrimuoveasync; aggiunge5_minutes,10_minutes,1_hour
- Aggiunto
- Guardrail e TTS
- I guardrail personalizzati aggiungono
modelehistory_message_countfacoltativi - Le impostazioni TTS degli agenti aggiungono
enable_phoneme_tagsfacoltativo
- I guardrail personalizzati aggiungono
- Telefonia
- I modelli dei trunk SIP aggiungono
enabled_codecsfacoltativo (enumMediaCodec)
- I modelli dei trunk SIP aggiungono
- Strumenti per memoria e codice
- Aggiunti
LoadableMemoryEntryeLoadMemoryEntryToolErrorStatus
- Aggiunti
- Test degli agenti
- Aumentati i limiti dei test collegati da 1000 a 5000 nelle richieste di esecuzione e reinvio
- Proprietà dello schema JSON degli strumenti
- Le proprietà degli array aggiungono
is_omittedfacoltativo
- Le proprietà degli array aggiungono
Workspace
- Account di servizio
- PATCH della chiave API supporta aggiornamenti parziali con sentinelle
no_update
- PATCH della chiave API supporta aggiornamenti parziali con sentinelle
- Utilizzo e cronologia
- L’utilizzo per prodotto nel tempo aggiunge
time_zonefacoltativo - I filtri
sourcedella cronologia aggiungonoFlows
- L’utilizzo per prodotto nel tempo aggiunge
Musica
- Piani di composizione
- Aggiunti
CompositionPlan,GenerationChunkeAudioRefChunkbasati su chunk permusic_v2 - I body delle richieste e delle risposte accettano formati di piano v1 o v2 con
anyOf
- Aggiunti
ElevenCreative Studio
- Modelli vocali del progetto
- Aggiunto
project_voice_ref_idcome riferimento vocale canonico - I mirror
voice_iddeprecati di sola lettura vengono mantenuti nelle risposte
- Aggiunto