対話を作成

テキストと音声IDのペアのリストを音声(対話)に変換し、オーディオを返します。

ヘッダー

xi-api-keystringオプション

クエリパラメータ

output_formatenumオプションデフォルト値 mp3_44100_128
生成されたオーディオの出力形式。codec_sample_rate_bitrate形式で指定します。たとえば、サンプルレート22.05kHz、32kbpsのmp3はmp3_22050_32で表します。ビットレート192kbpsのMP3を使用するには、クリエイター以上への加入が必要です。サンプルレート44.1kHzのPCMおよびWAV形式を使用するには、プロ以上への加入が必要です。μ-law形式(mu-lawとも表記され、u-lawと近似表記されることもあります)は、Twilioのオーディオ入力で一般的に使用されます。
enable_loggingbooleanオプションデフォルト値 true
enable_loggingがfalseに設定されている場合、このリクエストにはゼロ保持モードが使用されます。この場合、リクエスト結合を含む履歴機能はこのリクエストでは利用できません。ゼロ保持モードを使用できるのはエンタープライズのお客様のみです。

リクエスト

This endpoint expects an object.
inputslist of objects必須

テキストと、音声に変換する音声IDをそれぞれ含む対話入力のリストです。一意の音声IDは最大10件です。安定して生成するため、すべてのinputs[].text値の合計文字数は、リクエストあたり2,000文字以下にしてください。より長いリクエストでは、ストリーミングレスポンスが早期に終了するか、バリデーションエラーが返される場合があります。

model_idstringオプションデフォルト値 eleven_v3

使用するモデルの識別子。GET /v1/modelsで照会できます。モデルはテキスト読み上げをサポートしている必要があり、can_do_text_to_speechプロパティで確認できます。

language_codestring or nullオプション

モデルと言語正規化に適用する言語コード(ISO 639-1)です。モデルが指定された言語コードをサポートしていない場合は無視されます。このパラメータはmultilingual_v2モデルではサポートされません。

settingsobject or nullオプション

対話生成を制御する設定です。

previous_textstring or nullオプション<=100 characters

この生成の直前にあるテキスト。韻律の連続性を保つためにモデルを条件付けるために使用します。最大100文字を送信できます。すべてのモデルでサポートされているわけではありません。

future_textstring or nullオプション<=100 characters

この生成の直後に続くテキスト。韻律の連続性を保つためにモデルを条件付けるために使用します。最大100文字を送信できます。すべてのモデルでサポートされているわけではありません。

pronunciation_dictionary_locatorslist of objects or nullオプション

テキストに適用する発音辞書ロケーター(id、version_id)の一覧です。指定した順序で適用されます。1リクエストにつき最大3つのロケーターを指定できます。

seedinteger or nullオプション

指定すると、同じシードとパラメータでリクエストを繰り返した場合に同じ結果が返るよう、システムは決定論的サンプリングを最大限試みます。決定性は保証されません。0から4294967295までの整数である必要があります。

apply_text_normalizationenumオプションデフォルト値 auto

このパラメーターは、‘auto’、‘on’、‘off’の3つのモードでテキスト正規化を制御します。‘auto’に設定すると、システムがテキスト正規化(例:数値の読み上げ)を適用するかどうかを自動的に判断します。‘on’では常にテキスト正規化が適用され、‘off’ではスキップされます。

許可された値:
use_pvc_as_ivcbooleanオプションデフォルト値 false

プロフェッショナルボイスのIVCバージョンを使用するかどうかです。表現力が向上し、レイテンシーが低減する場合があります。

previous_request_idslist of strings or nullオプション

この生成より前に行われた対話生成のrequest_idsのリストです。大きなタスクを複数のリクエストに分割する際、連続性を保つためにモデルを条件付ける用途で使用します。送信できるrequest_idsは最大3件です。最後のrequest_idは、現在のリクエストに最も近い音声です。すべてのモデルでサポートされているわけではありません。

next_request_idslist of strings or nullオプション

この生成の後に行われる対話生成のrequest_idsのリストです。シーケンスの途中にあるクリップを再生成する際に、連続性を維持するのに役立ちます。送信できるrequest_idsは最大3件です。最初のrequest_idは、現在のリクエストに最も近い音声です。すべてのモデルでサポートされているわけではありません。

レスポンス

生成されたオーディオファイル

エラー

422
Unprocessable Entity Error