Czym jest Eleven v3?
Zalecamy przejście na Eleven v4 i przetestowanie go na własnych treściach.
Eleven v3 to ekspresyjny model Text to Speech o szerokim zakresie emocji. Generuje naturalną, realistyczną mowę z bogatą ekspresją emocjonalną i rozumieniem kontekstu w ponad 70 językach.
Eleven v3 oferuje:
- Obsługę tagów audio
- emocje:
[sad][angry][happily] - wskazówki dotyczące sposobu mówienia:
[whispers][shouts] - reakcje niewerbalne:
[laughs][clears throat][sighs]
- emocje:
- Tryb dialogu zapewniający naturalnie brzmiące audio z wieloma mówcami
- Obsługę ponad 70 języków
Ten model dobrze sprawdza się w rozmowach postaci, narracji audiobooków i emocjonalnych dialogach.
Możesz generować przez API za pomocą endpointów Utwórz mowę i Streamuj mowę, podając ID modelu eleven_v3.
Możesz też użyć endpointów Utwórz dialog i Streamuj dialog, aby stworzyć naturalnie brzmiący dialog z wieloma mówcami.
Więcej informacji znajdziesz w tych materiałach: