ボイスデザイン

Deprecated

テキストプロンプトから音声を作成します。

ヘッダー

xi-api-keystringオプション

クエリパラメータ

output_formatenumオプション

生成されたオーディオの出力形式。

リクエスト

This endpoint expects an object.
voice_descriptionstring必須20-1000 characters

作成する音声に使用する説明。

textstring or nullオプション100-1000 characters

生成するテキスト。テキストの長さは100~1000文字である必要があります。

auto_generate_textbooleanオプションデフォルト値 false

音声説明に適したテキストを自動生成するかどうか。

loudnessdoubleオプション-1-1デフォルト値 0.5

生成される音声の音量レベルを制御します。-1が最も小さく、1が最も大きく、0はおよそ-24 LUFSに相当します。

qualitydoubleオプション-1-1デフォルト値 0.9

品質を高くすると音声出力は向上しますが、バリエーションは少なくなります。

seedinteger or nullオプション0-2147483647

音声生成を制御する乱数。同じ入力で同じシードを使用すると、同じ音声が生成されます。

guidance_scaledoubleオプション0-100デフォルト値 5

AIがプロンプトにどの程度厳密に従うかを制御します。値が低いほどAIはより自由に創造性を発揮でき、値が高いほどプロンプトに厳密に従います。値が高いと、音声が不自然またはロボットのように聞こえることがあります。Guidance Scaleが低い場合は、より長く詳細なプロンプトを使用することをおすすめします。

should_enhancebooleanオプションデフォルト値 false

AIを使用して音声説明をより詳細にし、音声生成の品質を向上させるかどうか。有効にすると、システムは簡単なプロンプトをより詳細な音声説明へ自動的に展開します。デフォルトはFalseです

レスポンス

成功レスポンス。

previewslist of objects

生成された音声のプレビュー。

textstring

音声のプレビューに使用するテキストです。

エラー

409
Conflict Error
422
Unprocessable Entity Error