如何选择合适的模型

本指南介绍如何根据用例选择合适的 ElevenLabs 模型。

ElevenLabs 提供针对不同需求优化的一系列模型。正确选择取决于用例、延迟要求和质量预期。完整规格请参阅模型参考。

按需求选择

质量

使用 eleven_v4

旗舰模型,具有最高保真度、最丰富的情感表达和最广泛的语言支持。

低延迟

使用 eleven_v4_turbo

针对实时应用优化,延迟约为 100ms。

按用例选择

内容创作

使用 eleven_v4

适合专业内容、有声书和视频旁白配音。

对话式智能体

如需最具表现力的表达,使用 eleven_v4_turbo;如需最低延迟,使用 eleven_flash_v2_5 和 eleven_flash_v2。

对英语以外的语言支持,请使用 2.5 模型。

针对实时对话应用优化。

转录

批量转录使用 scribe_v2,医疗和临床音频使用 scribe_v2_medical,实时转录使用 scribe_v2_realtime。

支持 90 多种语言,具备先进准确度、说话人分离和词级时间戳。

变声器

使用 eleven_multilingual_sts_v2

专为语音转语音转换设计。

后续步骤