Eleven v3とは?
Eleven v3とは?
Eleven v4に切り替え、ご自身のコンテンツでテストすることをおすすめします。
Eleven v3は、感情豊かで表現力に優れたテキスト読み上げモデルです。70以上の言語で、高い感情表現力と文脈理解を備えた、自然で人間らしい音声を生成します。
Eleven v3の特長:
- オーディオタグに対応
- 感情:
[sad][angry][happily] - 読み上げの指示:
[whispers][shouts] - 非言語的な反応:
[laughs][clears throat][sighs]
- 感情:
- 複数話者による自然な音声のためのDialogueモード
- 70以上の言語に対応
このモデルは、キャラクター同士の会話、オーディオブックのナレーション、感情的な対話に適しています。
APIでは、モデルIDにeleven_v3を指定し、Create speechおよびStream speechエンドポイントを使用してv3で生成できます。
Create dialogueおよびStream dialogueエンドポイントを使用して、複数話者による自然な対話を作成することもできます。
詳しくは、以下のリソースをご覧ください: