什么是 Eleven v4?
什么是 Eleven v4?
建议切换到 Eleven v4,并用自己的内容进行测试。
建议切换到 Eleven v4,并用自己的内容进行测试。
Eleven v4 是我们最新、最先进的文本转语音模型,也是新一代模型中的首款产品。与 Eleven v3 相比,它提升了输出质量、音色准确度、情感表现、音频标签和语言覆盖范围。
Eleven v4 大幅提升了语音克隆准确度。与以往任何模型相比,克隆音色能更准确地还原源音色的特征——音色质感、节奏和表达方式。
Eleven v4 中的即时语音克隆(IVC)比以往更加准确。它能更忠实地捕捉源音色的关键特征,让你更轻松地通过短音频样本快速创建逼真的克隆音色。
Eleven v4 完全支持专业语音克隆(PVC)。它同样基于音色准确度的提升,为需要最高一致性和控制力的 workflow 提供更忠实的源音色还原。
Eleven v4 提供两个版本,可根据使用场景选择合适的质量与速度平衡:
- Eleven v4(
eleven_v4)——我们质量最高的模型,适合内容创作、有声书、角色旁白配音,以及任何将质量放在首位的使用场景。 - Eleven v4 Turbo(
eleven_v4_turbo)——在保持极高质量的同时实现出色的低延迟,专为对话式智能体和交互式语音体验等实时场景打造。
两个版本均使用两项音色设置:稳定性和相似度。Eleven v4 不提供风格和速度滑块,也不支持 SSML。
当生成语言与参考音色的语言一致时,会像以前一样完全保留原始口音。当生成语言与参考音色语言不同时,Eleven v4 会生成流畅自然的目标语言语音,而不会保留参考音色原始语言的口音。
可使用 Create speech 和 Stream speech,并指定模型 ID eleven_v4 来生成语音。对于多说话人内容,请使用 Create dialogue 和 Stream dialogue。
如需了解克隆、口音、对比及完整说明,请参阅 Eleven v4。如需了解标签和提示词,请参阅 Eleven v4 提示词。