Zremiksuj głos.
Zremiksuj głos.
Stwórz remix istniejącego głosu za pomocą promptu. Ta metoda zwraca listę podglądów głosu. Każdy podgląd zawiera generated_voice_id i próbkę głosu jako audio MP3 zakodowane w base64. Aby utworzyć głos, użyj generated_voice_id wybranego podglądu z endpointem /v1/text-to-voice.
Parametry ścieżki
Nagłówki
Parametry zapytania
Żądanie
Opis zmian, które należy wprowadzić w głosie.
Tekst do wygenerowania musi mieć od 100 do 1000 znaków.
Czy automatycznie generować tekst odpowiedni do opisu głosu.
Określa poziom głośności wygenerowanego głosu. -1 oznacza najciszej, 1 najgłośniej, a 0 odpowiada około -24 LUFS.
Liczba losowa sterująca generowaniem głosu. Ten sam seed przy tych samych danych wejściowych daje ten sam głos.
Określa, jak ściśle AI podąża za promptem. Niższe wartości dają AI większą swobodę twórczą, a wyższe zmuszają ją do bliższego trzymania się promptu. Wysokie wartości mogą sprawić, że głos zabrzmi sztucznie lub robotycznie. Przy niższej wartości Guidance Scale zalecamy używać dłuższych, bardziej szczegółowych promptów.
Określa, czy podglądy Text to Voice mają być uwzględnione w odpowiedzi. Jeśli wartość to true, zwrócone zostaną tylko wygenerowane identyfikatory, które można następnie przesyłać strumieniowo przez endpoint /v1/text-to-voice/:generated_voice_id/stream.
ID iteracji sesji remiksowania, do której należy dołączyć te generacje. Jeśli nie zostanie podane, zostanie utworzona nowa iteracja.
Określa równowagę między promptem a referencyjnym audio podczas generowania próbek głosu. 0 oznacza niemal brak wpływu promptu, a 1 — niemal brak wpływu referencyjnego audio. Obsługiwane tylko przez model eleven_ttv_v3.
Odpowiedź
Pomyślna odpowiedź
Podglądy wygenerowanych głosów.
Tekst używany do podglądu głosów.