Stimmenverzerrer
Überblick
Mit der ElevenLabs-Stimmenverzerrer-API können Sie jedes Quellaudio (aufgenommen oder hochgeladen) in eine andere, vollständig geklonte Stimme umwandeln, ohne die Nuancen der ursprünglichen Darbietung zu verlieren. Sie kann Flüstern, Lachen, Weinen, Akzente und subtile emotionale Hinweise erfassen, um einen äußerst realistischen, menschlichen Klang zu erzielen. Sie können damit:
- Jede Stimme ändern und dabei emotionale Sprechweise und Nuancen bewahren
- Konsistente Charakterstimmen über mehrere Sprachen und Aufnahmesitzungen hinweg erstellen
- Bestimmte Wörter und Phrasen in bestehenden Aufnahmen korrigieren oder ersetzen
Entdecken Sie unsere Stimmbibliothek, um die passende Stimme für Ihr Projekt zu finden.
Unterstützte Sprachen
Unsere mehrsprachigen v2-Modelle unterstützen 29 Sprachen:
Englisch (USA, UK, Australien, Kanada), Japanisch, Chinesisch, Deutsch, Hindi, Französisch (Frankreich, Kanada), Koreanisch, Portugiesisch (Brasilien, Portugal), Italienisch, Spanisch (Spanien, Mexiko), Indonesisch, Niederländisch, Türkisch, Filipino, Polnisch, Schwedisch, Bulgarisch, Rumänisch, Arabisch (Saudi-Arabien, VAE), Tschechisch, Griechisch, Finnisch, Kroatisch, Malaiisch, Slowakisch, Dänisch, Tamil, Ukrainisch & Russisch.
Das Modell eleven_english_sts_v2 unterstützt nur Englisch.
Wichtige Fakten
- Maximale Segmentlänge: 5 Minuten – teilen Sie längere Aufnahmen in Abschnitte auf
- Abrechnung: 1.000 Zeichen pro Minute verarbeitetem Audio
- Hintergrundgeräusche: Verwenden Sie
remove_background_noise=true, um Umgebungsgeräusche in der Ausgabe zu minimieren - Modellempfehlung:
eleven_multilingual_sts_v2übertriffteleven_english_sts_v2oft selbst bei englischen Inhalten - Benutzerdefinierte Stimmen: Jede geklonte oder erstellte Stimme in Ihrer Bibliothek kann als Ausgabestimme verwendet werden; geben Sie ihre
voice_idan