Czym jest Eleven v3?

Zalecamy przejście na Eleven v4 i przetestowanie go na własnych treściach.

Zalecamy przejście na Eleven v4 i przetestowanie go na własnych treściach. Wiele technik promptowania dla Eleven v4 działa też w Eleven v3.

Eleven v3 to ekspresyjny model Text to Speech o szerokim zakresie emocji. Generuje naturalną, realistyczną mowę z bogatą ekspresją emocjonalną i rozumieniem kontekstu w ponad 70 językach.

Eleven v3 oferuje:

  • Obsługę tagów audio
    • emocje: [sad] [angry] [happily]
    • wskazówki dotyczące sposobu mówienia: [whispers] [shouts]
    • reakcje niewerbalne: [laughs] [clears throat] [sighs]
  • Tryb dialogu zapewniający naturalnie brzmiące audio z wieloma mówcami
  • Obsługę ponad 70 języków

Ten model dobrze sprawdza się w rozmowach postaci, narracji audiobooków i emocjonalnych dialogach.

Możesz generować przez API za pomocą endpointów Utwórz mowę i Streamuj mowę, podając ID modelu eleven_v3.

Możesz też użyć endpointów Utwórz dialog i Streamuj dialog, aby stworzyć naturalnie brzmiący dialog z wieloma mówcami.

Więcej informacji znajdziesz w tych materiałach: