Hoppa till navigering

Snabbstart för Voice Design

Den här guiden visar hur du designar en röst med en textprompt via Voice Design API.

Den här guiden visar hur du designar en röst med en prompt via Voice Design API.

Använda Voice Design API

Den här guiden förutsätter att du har konfigurerat din API-nyckel och SDK. Slutför snabbstartsguiden först om du inte redan har gjort det. För att spela upp ljud via dina högtalare kan du även behöva MPV och/eller ffmpeg.

1

Gör API-begäran

Att designa en röst med en prompt har två steg:

  1. Generera förhandsvisningar utifrån en prompt.
  2. Välj den bästa förhandsvisningen och använd den för att skapa en ny röst.

Vi börjar med att generera förhandsvisningar utifrån en prompt.

Skapa en ny fil med namnet example.py eller example.mts, beroende på vilket språk du väljer, och lägg till följande kod:

# example.py
from dotenv import load_dotenv
from elevenlabs.client import ElevenLabs
from elevenlabs.play import play
import base64
load_dotenv()
elevenlabs = ElevenLabs(
api_key=os.getenv("ELEVENLABS_API_KEY"),
)
voices = elevenlabs.text_to_voice.design(
model_id="eleven_multilingual_ttv_v2",
voice_description="A massive evil ogre speaking at a quick pace. He has a silly and resonant tone.",
text="Your weapons are but toothpicks to me. Surrender now and I may grant you a swift end. I've toppled kingdoms and devoured armies. What hope do you have against me?",
)
for preview in voices.previews:
# Convert base64 to audio buffer
audio_buffer = base64.b64decode(preview.audio_base_64)
print(f"Playing preview: {preview.generated_voice_id}")
play(audio_buffer)
2

Kör koden

python example.py

Du bör höra de genererade röstförhandsvisningarna spelas upp genom dina högtalare, en i taget.

3

Lägg till den genererade rösten i ditt bibliotek

När du har genererat förhandsvisningarna och valt din favorit kan du lägga till den i ditt röstbibliotek via det genererade röst-ID:t, så att den kan användas med andra API:er.

voice = elevenlabs.text_to_voice.create(
voice_name="Jolly giant",
voice_description="A huge giant, at least as tall as a building. A deep booming voice, loud and jolly.",
# The generated voice ID of the preview you want to use,
# using the first in the list for this example
generated_voice_id=voices.previews[0].generated_voice_id
)
print(voice.voice_id)

Nästa steg