Guida rapida di Text to Dialogue
Questa guida ti mostrerà come generare dialoghi coinvolgenti e dal suono naturale a partire dal testo utilizzando l’API Text to Dialogue.
Per una generazione affidabile, mantieni la lunghezza totale di tutti i valori inputs[].text pari o inferiore a 2.000 caratteri per richiesta.
Dividi gli script più lunghi in blocchi e unisci l’audio lato client.
Utilizzare l’API Text to Dialogue
Crea una chiave API
Crea qui una chiave API nella dashboard, che userai per accedere all’API in modo sicuro.
Archivia la chiave come secret gestito e passala agli SDK come variabile d’ambiente tramite un file .env oppure direttamente nella configurazione della tua app, a seconda delle tue preferenze.
Installa l'SDK
SDK
CLI
Useremo anche la libreria dotenv per caricare la nostra chiave API da una variabile d’ambiente.
Effettua la richiesta API
SDK
CLI
Crea un nuovo file denominato example.py o example.mts, a seconda del linguaggio scelto, e aggiungi il seguente codice.
Aggiungi tag audio all’interno di ogni valore text per guidare l’interpretazione di quel parlante. Il parametro voice_id
seleziona la voce del parlante per lo stesso elemento di input.
Quindi eseguilo:
Dovresti sentire la riproduzione dell’audio del dialogo.
Streaming WebSocket
Per dialoghi incrementali su una connessione di lunga durata con i modelli Eleven v3, segui Text to Dialogue in tempo reale. Per confrontare questo WebSocket con il WebSocket TTS standard, consulta WebSocket Text to Speech e Text to Dialogue.