Was ist Eleven v3?
Wir empfehlen, zu Eleven v4 zu wechseln und es mit Ihren eigenen Inhalten zu testen.
Eleven v3 ist ein emotional vielseitiges, ausdrucksstarkes Text to Speech-Modell. Es erzeugt natürliche, lebensechte Sprache mit großer emotionaler Bandbreite und Kontextverständnis in über 70 Sprachen.
Eleven v3 bietet:
- Unterstützung für Audio-Tags
- Emotionen:
[sad][angry][happily] - Sprechweise:
[whispers][shouts] - Nonverbale Reaktionen:
[laughs][clears throat][sighs]
- Emotionen:
- Dialogmodus für natürlich klingendes Audio mit mehreren Sprechern
- Unterstützung für über 70 Sprachen
Dieses Modell eignet sich gut für Charakterdialoge, Hörbuchnarration und emotionale Dialoge.
Sie können über die API mit unseren Endpunkten Create speech und Stream speech generieren, indem Sie die Modell-ID eleven_v3 angeben.
Sie können auch unsere Endpunkte Create dialogue und Stream dialogue verwenden, um natürlich klingende Dialoge mit mehreren Sprechern zu erstellen.
Weitere Informationen finden Sie in folgenden Ressourcen: