Eleven Music

了解如何使用 ElevenLabs 的自然语言提示词创作任意风格的录音室级音乐。

概述

Eleven Music 是一款文本转音乐模型,可通过自然语言提示词生成任意风格的录音室级音乐。它旨在理解你的意图,并根据目标生成完整、贴合上下文的音频。该模型既理解自然语言,也理解音乐术语,提供先进功能:

  • 完整控制流派、风格和结构
  • 可生成带人声或纯器乐作品
  • 支持多语言,包括英语、西班牙语、德语、日语等
  • 编辑单个段落或整首歌曲的声音和歌词

试听示例:

Eleven Music 与唱片公司、出版商和艺术家合作打造,已获授权,可用于几乎所有商业用途,包括影视、播客、社交媒体视频、广告和游戏。有关不同套餐支持的使用方式,请查看音乐条款。

音频参考

音频参考功能允许你上传一段简短音轨,以引导新的 Music v2 或 v2.5 生成内容的风格和声音。除文本提示词外,这会为模型提供额外的创意参考。

要使用音频参考,请进入 音乐 > 生成记录,然后在 提示词 区域使用 + 参考 按钮添加音频参考。

可以上传时长约 30 秒以内、采用常见音频格式的参考音轨。每段上传的参考音频在使用前都会经过版权合规审核。

音频参考会影响生成音轨的整体声音、制作风格、配器、节奏和情绪等特征。它不会复制或混音上传的音频,结果始终是新生成的作品。

音频参考旨在引导生成内容接近某种风格和声音,并非用于流派转换。例如,上传爵士音轨并要求生成说唱 版本,可能无法获得可靠结果。

所有付费套餐均可使用 Music v2 和 v2.5 的音频参考功能。

音乐 Finetune

将 ElevenLabs 音乐模型微调为你的专属声音。音乐 Finetune 支持使用自己的音频微调模型。上传你拥有的无版权争议音轨,即可创建个性化音乐模型版本,始终体现你的风格、声音特色或品牌。

标准音乐生成可以制作高质量音轨,但输出内容在配器、质感、制作风格和感觉方面可能差异很大。Finetune 可让生成内容基于你特定的音频身份。训练完成后,使用 Finetune 生成的每首音轨都会体现数据集的音色、结构和特征,同时仍是全新原创作品。

Finetune 可解决 AI 音乐生成的 3 个核心难题:

  • 品牌无法仅靠提示词打造专属声音
  • 创作者无法在不同项目中稳定复现自己的风格
  • 探索新想法的音乐人希望输出内容能忠实于自己的作品风格

通过在你的音轨上微调,创建的自定义 Finetune 能捕捉配器、节奏、制作风格、音色和人声特征等风格模式。

工作原理

  • 上传无版权争议音轨,我们会自动进行版权合规审核
  • Finetune 约 5-10 分钟即可使用
  • 在 ElevenCreative 中使用自定义 Finetune 生成音乐

符合条件的企业版客户可使用自己完全拥有并控制的专有知识产权进行微调,无需经过第三方版权审核。此功能专为拥有 独家所有目录的组织设计。请联系客户经理启用此功能。

精选 Finetune

除自定义训练外,ElevenCreative 还包含 ElevenLabs 创建的精选 Finetune,涵盖全球流派和风格,包括:

  • Afro House Beats
  • Reggaeton
  • Arabic Groove
  • 70s Cambodian Rock
  • 80s Nu-Disco Revival
  • Mozart-Style Symphony

符合条件的订阅者可立即使用,无需上传。

使用方式

Eleven Music 现已在 ElevenLabs 网站上线。付费订阅者可使用 Music API,与 Agents Platform 的集成即将推出。

Eleven Music 与唱片公司、出版商和艺术家合作打造,已获授权,可用于几乎所有商业用途,包括影视、播客、社交媒体视频、广告和游戏。有关不同套餐支持的使用方式,请查看音乐条款。

关键信息

Music v2.5 是我们最先进的音乐模型。它基于 Music v2,提升了音频质量和提示词遵循度,并支持相同的工作流程,包括作曲计划、音频 参考和局部重绘。可在 Eleven Music 界面的模型下拉菜单中选择,或在 API 中传入 model_id="music_v2_5"。Music v2 仍然可用。

Music v2 是下一代 ElevenLabs AI 音乐模型,相较 Music v1,在提示词遵循度、作曲、提示词理解、多语言输出和人声表现方面均有提升。新增功能 包括:

  • 使用上传的短音轨通过音频参考引导生成
  • 长篇幅、逐段作曲
  • 音轨中途流派转换
  • 更快速、更复杂的人声表现,包括快速说唱和密集歌词模式
  • 改进的局部重绘
  • 嵌入音轨内的音效

Music v1 会在过渡期内继续可用。Music v2 是 UI 中新的默认模型。对于 API 生成,Music v1 会在过渡期内继续作为默认模型。过渡期结束后,Music v2 将成为 UI 和 API 中的默认模型。Music v1 停用前,至少会提前数月通知。

在 UI 中选择已生成歌曲的特定段落,仅重新生成该段落而不影响音轨其余部分。v2 的局部重绘质量有所提升。

生成音乐最短时长为 3 秒,最长时长为 5 分钟。

有关更多信息,请参阅开发者快速入门。

可以。Eleven Music 已获授权,可用于几乎所有商业用途,包括影视、播客、社交媒体视频、广告和游戏。有关不同套餐支持的使用方式,请查看音乐条款。

生成的音频提供 MP3(44.1kHz、128-192kbps)和 WAV 格式。

音频参考功能允许你上传一段时长约 30 秒以内的音轨,以引导新的 Music v2 或 v2.5 生成内容的风格和声音。上传的音轨会与提示词一起作为创意指引,且每次上传都会经过版权合规审核。

音频参考不是混音或流派转换工具。它会引导声音、情绪、配器和制作风格等特征。当所需输出与上传参考存在较大差异时,结果可能不够可靠,例如使用爵士参考来要求生成说唱音轨。