Eleven v3とは?

Eleven v4に切り替え、ご自身のコンテンツでテストすることをおすすめします。

Eleven v4に切り替え、ご自身のコンテンツでテストすることをおすすめします。Eleven v4のプロンプト手法の多くは、 Eleven v3にも適用できます。

Eleven v3は、感情豊かで表現力に優れたテキスト読み上げモデルです。70以上の言語で、高い感情表現力と文脈理解を備えた、自然で人間らしい音声を生成します。

Eleven v3の特長:

  • オーディオタグに対応
    • 感情:[sad] [angry] [happily]
    • 読み上げの指示:[whispers] [shouts]
    • 非言語的な反応:[laughs] [clears throat] [sighs]
  • 複数話者による自然な音声のためのDialogueモード
  • 70以上の言語に対応

このモデルは、キャラクター同士の会話、オーディオブックのナレーション、感情的な対話に適しています。

APIでは、モデルIDにeleven_v3を指定し、Create speechおよびStream speechエンドポイントを使用してv3で生成できます。

Create dialogueおよびStream dialogueエンドポイントを使用して、複数話者による自然な対話を作成することもできます。

詳しくは、以下のリソースをご覧ください: