声音设计
声音设计
根据文本提示词创建音色。
请求头
xi-api-key
查询参数
output_format
生成音频的输出格式。
请求
This endpoint expects an object.
voice_description
用于创建音色的说明。
text
要生成的文本,长度必须在 100 到 1000 之间。
auto_generate_text
是否自动生成适合音色描述的文本。
loudness
控制生成语音的音量级别。-1 最安静,1 最响,0 大致对应 -24 LUFS。
quality
更高质量可带来更好的语音输出,但多样性较低。
seed
控制语音生成的随机数。相同种子和相同输入会生成相同的语音。
guidance_scale
Controls how closely the AI follows the prompt. Lower numbers give the AI more freedom to be creative, while higher numbers force it to stick more to the prompt. High numbers can cause voice to sound artificial or robotic. We recommend to use longer, more detailed prompts at lower Guidance Scale.
should_enhance
是否使用 AI 增强声音描述,以补充更多细节并提升语音生成质量。启用后,系统会自动将简单提示词扩展为更详细的声音描述。默认为 False。
响应
成功响应
previews
生成音色的预览。
text
用于预览音色的文本。
错误
409
Conflict Error
422
Unprocessable Entity Error