Qu’est-ce qu’Eleven v3 ?

Nous vous recommandons de passer à Eleven v4 et de le tester avec votre propre contenu.

Nous vous recommandons de passer à Eleven v4 et de le tester avec votre propre contenu. De nombreuses techniques de prompting pour Eleven v4 s’appliquent également à Eleven v3.

Eleven v3 est un modèle Text to Speech expressif, doté d’une riche palette émotionnelle. Il produit une voix naturelle et réaliste, avec une large gamme d’émotions et une compréhension contextuelle dans plus de 70 langues.

Eleven v3 propose :

  • La prise en charge des balises audio
    • émotions : [sad] [angry] [happily]
    • indications de delivery : [whispers] [shouts]
    • réactions non verbales : [laughs] [clears throat] [sighs]
  • Un mode dialogue pour un audio naturel avec plusieurs locuteurs
  • La prise en charge de plus de 70 langues

Ce modèle convient particulièrement aux discussions entre personnages, à la narration de livres audio et aux dialogues émotionnels.

Vous pouvez générer du contenu avec v3 via l’API, en utilisant nos endpoints Create speech et Stream speech, en indiquant l’ID de modèle eleven_v3.

Vous pouvez également utiliser nos endpoints Create dialogue et Stream dialogue pour créer un dialogue naturel entre plusieurs locuteurs.

Consultez les ressources suivantes pour en savoir plus :