创建音效

使用世界先进的音效模型,将文本转换为适用于视频、旁白配音或电子游戏的音效。

请求头

xi-api-keystring可选

查询参数

output_formatenum可选
生成音频的输出格式。格式为 codec_sample_rate_bitrate。因此,采样率为 22.05kHz、比特率为 32kbs 的 mp3 表示为 mp3_22050_32。使用 192kbps 比特率的 MP3 需要订阅 Creator 或更高版本。采样率为 44.1kHz 的 PCM 格式需要订阅 Pro 或更高版本。请注意,μ-law 格式(有时写作 mu-law,通常近似写作 u-law)常用于 Twilio 音频输入。

请求

This endpoint expects an object.
textstring必需

将转换为音效的文本。

loopboolean可选默认为 false

是否创建可无缝循环的音效。仅适用于 ‘eleven_text_to_sound_v2 model’。

duration_secondsdouble or null可选

要生成的音效时长,单位为秒。必须至少为 0.5,最多为 30。设为 None 时,将根据提示词推测最佳时长。默认值为 None。

prompt_influencedouble or null可选默认为 0.3

更高的提示词影响力会使生成结果更贴合提示词,但也会降低生成结果的变化性。必须为 0 到 1 之间的值。默认值为 0.3。

model_idenum可选默认为 eleven_text_to_sound_v2

用于生成音效的模型 ID。

允许的值:

响应头

character-coststring可选

用于计费的字符数

响应

生成的音效,以 MP3 文件形式提供

错误

422
Unprocessable Entity Error