Was ist Eleven v4?

Wir empfehlen, zu Eleven v4 zu wechseln und es mit Ihren eigenen Inhalten zu testen.
Wir empfehlen, zu Eleven v4 zu wechseln und es mit Ihren eigenen Inhalten zu testen.

Eleven v4 ist unser neuestes und fortschrittlichstes Text to Speech-Modell sowie das erste einer neuen Modellgeneration. Im Vergleich zu Eleven v3 verbessert es Ausgabequalität, Stimmgenauigkeit, Emotionen, Audio-Tags und Sprachabdeckung.

Die Genauigkeit beim Klonen von Stimmen macht mit Eleven v4 einen großen Schritt nach vorn. Geklonte Stimmen erfassen die Eigenschaften der Ausgangsstimme — Klangfarbe, Rhythmus und Sprechweise — originalgetreuer als mit jedem vorherigen Modell.

Instant Voice Clones (IVCs) sind mit Eleven v4 präziser als je zuvor. Sie erfassen die prägenden Eigenschaften einer Ausgangsstimme originalgetreuer, sodass sich schnell und einfach aus einem kurzen Audiobeispiel ein überzeugender Klon erstellen lässt.

Professional Voice Clones (PVCs) werden in Eleven v4 vollständig unterstützt. Sie bauen auf denselben Fortschritten bei der Stimmgenauigkeit auf und bieten für Workflows, die ein Höchstmaß an Konsistenz und Kontrolle erfordern, eine originalgetreuere Wiedergabe der Ausgangsstimme.

Eleven v4 ist in zwei Varianten verfügbar. So können Sie für Ihren Anwendungsfall das richtige Verhältnis von Qualität und Geschwindigkeit wählen:

  • Eleven v4 (eleven_v4) — unser Modell mit der höchsten Qualität, ideal für Content-Erstellung, Hörbücher, Charakter-Voiceovers und alle Anwendungsfälle, bei denen Qualität oberste Priorität hat.
  • Eleven v4 Turbo (eleven_v4_turbo) — extrem hohe Qualität bei beeindruckend niedriger Latenz, speziell entwickelt für Echtzeitanwendungen wie Gesprächsagenten und interaktive Spracherlebnisse.

Beide Varianten verwenden zwei Stimmeinstellungen: Stabilität und Ähnlichkeit. Die Regler für Stil und Geschwindigkeit sind in Eleven v4 nicht verfügbar, und SSML wird nicht unterstützt.

Wenn die Sprache, die Sie generieren, mit der Sprache Ihrer Referenzstimme übereinstimmt, bleibt der ursprüngliche Akzent unverändert erhalten. Wenn sich die generierte Sprache von der Sprache der Referenzstimme unterscheidet, erzeugt Eleven v4 flüssige, natürlich klingende Sprache in der Zielsprache — statt den Akzent der Referenzstimme aus ihrer ursprünglichen Sprache zu übernehmen.

Sie können mit Create speech und Stream speech unter Verwendung der Modell-ID eleven_v4 generieren. Für mehrere Sprecher verwenden Sie Create dialogue und Stream dialogue.

Informationen zu Klonen, Akzenten, Vergleichen und die vollständige Beschreibung finden Sie unter Eleven v4. Informationen zu Tags und Prompting finden Sie unter Prompting für Eleven v4.