Krótki przewodnik po Speech to Text
Krótki przewodnik po Speech to Text
Dowiedz się, jak zamienić mówione audio na tekst.
Ten przewodnik pokaże ci, jak zamienić nagranie mowy na tekst za pomocą API Speech to Text.
Użyj umiejętności zamiany mowy na tekst ElevenLabs, aby transkrybować audio z pomocą asystenta AI do programowania:
Ten tutorial pokazuje, jak korzystać z API Batch Speech to Text. Przewodniki po API Realtime Speech to Text znajdziesz tutaj: streaming po stronie klienta lub streaming po stronie serwera.
Korzystanie z API Speech to Text
Utwórz klucz API
Utwórz klucz API w panelu tutaj, aby bezpiecznie uzyskać dostęp do API.
Przechowuj klucz jako zarządzany sekret i przekaż go do SDK jako zmienną środowiskową przez plik .env lub bezpośrednio w konfiguracji aplikacji — zależnie od preferencji.
Wyślij żądanie API
SDK
CLI
Utwórz plik example.py lub example.mts, zależnie od wybranego języka, i dodaj ten kod:
Następnie uruchom plik:
W konsoli powinna pojawić się transkrypcja pliku audio.
W przypadku nagrań medycznych i klinicznych ustaw model_id na scribe_v2_medical. Format żądania
jest taki sam jak dla scribe_v2, a cena również. Zobacz Scribe v2
Medical.