人声分离快速入门

了解如何使用人声分离 API 移除音频文件中的背景噪声。

本指南将介绍如何使用人声分离 API 移除音频文件中的背景噪声。

使用 ElevenLabs voice-isolator skill,通过 AI 编程助手移除音频文件中的背景噪声:

npx skills add elevenlabs/skills --skill voice-isolator

使用人声分离 API

1

创建 API 密钥

在控制台创建 API 密钥,用于安全地访问 API。

将密钥存储为托管密钥,并根据需要通过 .env 文件将其作为环境变量传递给 SDK,或直接在应用配置中设置。

.env
ELEVENLABS_API_KEY=<your_api_key_here>
2

安装 SDK

我们还会使用 dotenv 库从环境变量加载 API 密钥。

pip install elevenlabs
pip install python-dotenv

如需通过扬声器播放音频,系统可能会提示你安装 MPV 和/或 ffmpeg。

3

发起 API 请求

根据所选语言,新建名为 example.py 或 example.mts 的文件,然后添加以下代码:

# example.py
import os
from dotenv import load_dotenv
from elevenlabs.client import ElevenLabs
from elevenlabs.play import play
import requests
from io import BytesIO
load_dotenv()
elevenlabs = ElevenLabs(
api_key=os.getenv("ELEVENLABS_API_KEY"),
)
audio_url = "https://storage.googleapis.com/eleven-public-cdn/documentation_assets/audio/voice_with_background.mp3"
response = requests.get(audio_url)
audio_data = BytesIO(response.content)
audio_stream = elevenlabs.audio_isolation.convert(audio=audio_data)
play(audio_stream)

然后运行:

python example.py

应该会听到扬声器播放分离后的人声。

后续步骤