Guida rapida a Speech to Text
Questa guida ti mostrerà come convertire l’audio parlato in testo utilizzando l’API Speech to Text.
Usa la skill speech-to-text di ElevenLabs per trascrivere l’audio dal tuo assistente di coding IA:
Questo tutorial mostrerà come usare l’API batch Speech to Text. Per una guida su come usare l’API Speech to Text Realtime, consulta le guide su streaming lato client o streaming lato server.
Utilizzo dell’API Speech to Text
Crea una chiave API
Crea qui una chiave API nella dashboard, che userai per accedere all’API in modo sicuro.
Archivia la chiave come secret gestito e passala agli SDK come variabile d’ambiente tramite un file .env oppure direttamente nella configurazione della tua app, a seconda delle tue preferenze.
Installa l'SDK
SDK
CLI
Useremo anche la libreria dotenv per caricare la nostra chiave API da una variabile d’ambiente.
Effettua la richiesta API
SDK
CLI
Crea un nuovo file denominato example.py o example.mts, a seconda del linguaggio che preferisci, e aggiungi il seguente codice:
Quindi eseguilo:
Dovresti vedere la trascrizione del file audio stampata nella console.
Per l’audio medico e clinico, imposta model_id su scribe_v2_medical. La struttura della richiesta
è la stessa di scribe_v2 e viene fatturata alla stessa tariffa. Consulta Scribe v2
Medical.