Strumień Voice Changer
Strumień Voice Changer
Strumieniuj audio z jednego głosu do drugiego. Zachowaj pełną kontrolę nad emocjami, tempem i sposobem wypowiedzi.
Parametry ścieżki
ID głosu do użycia. Wszystkie dostępne głosy możesz wyświetlić za pomocą endpointu Pobierz głosy.
Nagłówki
Parametry zapytania
Gdy enable_logging ma wartość false, dla żądania zostanie użyty tryb zerowej retencji. Funkcje historii, w tym łączenie żądań, będą niedostępne dla tego żądania. Z trybu zerowej retencji mogą korzystać tylko klienci Enterprise.
Żądanie
Plik audio zawierający treść i emocje, które będą sterować generowaną mową.
Identyfikator modelu, który zostanie użyty. Możesz sprawdzić dostępne modele za pomocą GET /v1/models. Model musi obsługiwać mowę-mowa, co możesz sprawdzić we właściwości can_do_voice_conversion.
Ustawienia głosu nadpisujące zapisane ustawienia danego głosu. Są stosowane tylko w tym żądaniu. Muszą zostać wysłane jako ciąg zakodowany w JSON.
Jeśli podano, nasz system dołoży starań, by generowanie było deterministyczne, więc powtarzane żądania z tym samym seedem i parametrami powinny zwracać ten sam wynik. Determinizm nie jest gwarantowany. Musi być liczbą całkowitą od 0 do 4294967295.
Jeśli ustawione, usunie szum tła z wejścia audio za pomocą naszego modelu izolacji audio. Dotyczy tylko Voice Changer.
The format of input audio. Options are ‘pcm_s16le_16’ or ‘other’ For pcm_s16le_16, the input audio must be 16-bit PCM at a 16kHz sample rate, single channel (mono), and little-endian byte order. Latency will be lower than with passing an encoded waveform.
Odpowiedź
Dane audio przesyłane strumieniowo