Forced-Alignment-Schnellstart

Erfahren Sie, wie Sie mit der Forced Alignment API Text mit Audio abgleichen.

Diese Anleitung zeigt Ihnen, wie Sie mit der Forced Alignment API Text mit Audio abgleichen.

Forced Alignment API verwenden

1

API-Schlüssel erstellen

Erstellen Sie hier im Dashboard einen API-Schlüssel, den Sie für den sicheren Zugriff auf die API verwenden.

Speichern Sie den Schlüssel als verwaltetes Secret und übergeben Sie ihn je nach Präferenz an die SDKs entweder als Umgebungsvariable über eine .env-Datei oder direkt in der Konfiguration Ihrer App.

.env
ELEVENLABS_API_KEY=<your_api_key_here>
2

SDK installieren

Wir verwenden außerdem die Bibliothek dotenv, um unseren API-Schlüssel aus einer Umgebungsvariable zu laden.

pip install elevenlabs
pip install python-dotenv
3

API-Anfrage stellen

Erstellen Sie je nach bevorzugter Sprache eine neue Datei namens example.py oder example.mts und fügen Sie den folgenden Code hinzu:

# example.py
import os
from io import BytesIO
from elevenlabs.client import ElevenLabs
import requests
from dotenv import load_dotenv
load_dotenv()
elevenlabs = ElevenLabs(
api_key=os.getenv("ELEVENLABS_API_KEY"),
)
audio_url = (
"https://storage.googleapis.com/eleven-public-cdn/audio/marketing/nicole.mp3"
)
response = requests.get(audio_url)
audio_data = BytesIO(response.content)
# Perform the text-to-speech conversion
transcription = elevenlabs.forced_alignment.create(
file=audio_data,
text="With a soft and whispery American accent, I'm the ideal choice for creating ASMR content, meditative guides, or adding an intimate feel to your narrative projects."
)
print(transcription)

Führen Sie die Datei anschließend aus:

python example.py

In der Konsole sollte das Transkript der Audiodatei mit exakten Zeitstempeln angezeigt werden.

Nächste Schritte