快速开始如何选择合适的模型复制页面本指南介绍如何根据用例选择合适的 ElevenLabs 模型。ElevenLabs 提供针对不同需求优化的一系列模型。正确选择取决于用例、延迟要求和质量预期。完整规格请参阅模型参考。 按需求选择 质量使用 eleven_v4旗舰模型,具有最高保真度、最丰富的情感表达和最广泛的语言支持。低延迟使用 eleven_v4_turbo针对实时应用优化,延迟约为 100ms。 按用例选择 内容创作使用 eleven_v4适合专业内容、有声书和视频旁白配音。对话式智能体如需最具表现力的表达,使用 eleven_v4_turbo;如需最低延迟,使用 eleven_flash_v2_5 和 eleven_flash_v2。对英语以外的语言支持,请使用 2.5 模型。针对实时对话应用优化。转录批量转录使用 scribe_v2,医疗和临床音频使用 scribe_v2_medical,实时转录使用 scribe_v2_realtime。支持 90 多种语言,具备先进准确度、说话人分离和词级时间戳。变声器使用 eleven_multilingual_sts_v2专为语音转语音转换设计。 后续步骤 模型查看完整模型规格、延迟基准和功能对比。延迟优化通过模型选择、音色选择和地理路由缩短首段音频时间。