Voice Design

Deprecated

Utwórz głos na podstawie promptu tekstowego.

Nagłówki

xi-api-keystringOpcjonalny

Parametry zapytania

output_formatenumOpcjonalny

Format wyjściowy wygenerowanego audio.

Żądanie

This endpoint expects an object.
voice_descriptionstringWymagany20-1000 characters

Opis dla utworzonego głosu.

textstring or nullOpcjonalny100-1000 characters

Tekst do wygenerowania musi mieć od 100 do 1000 znaków.

auto_generate_textbooleanOpcjonalnyDomyślnie false

Czy automatycznie generować tekst odpowiedni do opisu głosu.

loudnessdoubleOpcjonalny-1-1Domyślnie 0.5

Określa poziom głośności wygenerowanego głosu. -1 oznacza najciszej, 1 najgłośniej, a 0 odpowiada około -24 LUFS.

qualitydoubleOpcjonalny-1-1Domyślnie 0.9

Wyższa jakość daje lepszy głos, ale mniejszą różnorodność.

seedinteger or nullOpcjonalny0-2147483647

Liczba losowa sterująca generowaniem głosu. Ten sam seed przy tych samych danych wejściowych daje ten sam głos.

guidance_scaledoubleOpcjonalny0-100Domyślnie 5

Określa, jak ściśle AI podąża za promptem. Niższe wartości dają AI większą swobodę twórczą, a wyższe zmuszają ją do bliższego trzymania się promptu. Wysokie wartości mogą sprawić, że głos zabrzmi sztucznie lub robotycznie. Przy niższej wartości Guidance Scale zalecamy używać dłuższych, bardziej szczegółowych promptów.

should_enhancebooleanOpcjonalnyDomyślnie false

Czy ulepszać opis głosu za pomocą AI, by dodać więcej szczegółów i poprawić jakość generowania głosu. Po włączeniu system automatycznie rozwinie proste prompty w bardziej szczegółowe opisy głosu. Domyślnie False

Odpowiedź

Pomyślna odpowiedź

previewslist of objects

Podglądy wygenerowanych głosów.

textstring

Tekst używany do podglądu głosów.

Błędy

409
Conflict Error
422
Unprocessable Entity Error