Stream do Modificador de Voz IA
Transmita o áudio de uma voz para outra. Mantenha total controle sobre emoção, ritmo e interpretação.
Parâmetros de caminho
ID da voz a ser usada. Use o endpoint Get voices para listar todas as vozes disponíveis.
Cabeçalhos
Parâmetros de consulta
Solicitação
O arquivo de áudio que contém o conteúdo e a emoção que controlarão a fala gerada.
Identificador do modelo que será usado. Você pode consultá-lo usando GET /v1/models. O modelo precisa oferecer suporte a conversão de voz para voz, o que pode ser verificado pela propriedade can_do_voice_conversion.
Configurações de voz que substituem as configurações armazenadas para a voz fornecida. Elas são aplicadas somente à solicitação fornecida. Devem ser enviadas como uma string codificada em JSON.
Se especificado, nosso sistema fará o possível para realizar a amostragem de forma determinística, de modo que solicitações repetidas com a mesma semente e os mesmos parâmetros retornem o mesmo resultado. O determinismo não é garantido. Deve ser um número inteiro entre 0 e 4294967295.
Se definido, removerá o ruído de fundo da sua entrada de áudio usando nosso modelo de isolamento de áudio. Aplica-se somente ao Modificador de Voz IA.
The format of input audio. Options are ‘pcm_s16le_16’ or ‘other’ For pcm_s16le_16, the input audio must be 16-bit PCM at a 16kHz sample rate, single channel (mono), and little-endian byte order. Latency will be lower than with passing an encoded waveform.
Resposta
Dados de áudio em streaming