最適なモデルの選び方

このガイドでは、ユースケースに最適なElevenLabsモデルの選び方を紹介します。

ElevenLabsは、さまざまな要件に最適化されたモデルを提供しています。最適なモデルは、ユースケース、レイテンシ要件、求める品質によって異なります。詳細な仕様はモデルリファレンスをご覧ください。

要件別

品質

eleven_v4を使用

最高の忠実度、豊かな感情表現、幅広い言語サポートを備えたフラッグシップモデルです。

低レイテンシ

eleven_v4_turboを使用

約75msのレイテンシで、リアルタイムアプリケーション向けに最適化されています。

ユースケース別

コンテンツ制作

eleven_v4を使用

プロフェッショナルなコンテンツ、オーディオブック、ビデオナレーションに最適です。

会話型エージェント

最も表現力豊かな音声にはeleven_v4_turboを、最小のレイテンシにはeleven_flash_v2_5またはeleven_flash_v2を使用します。

英語以外の言語をサポートする場合は、2.5モデルを使用してください。

リアルタイムの会話型アプリケーション向けに最適化されています。

文字起こし

バッチ文字起こしにはscribe_v2を、医療・臨床オーディオにはscribe_v2_medicalを、 リアルタイム文字起こしにはscribe_v2_realtimeを使用します。

話者ダイアライゼーションと単語レベルのタイムスタンプに対応し、90以上の言語で最先端の精度を実現します。

ボイスチェンジャー

eleven_multilingual_sts_v2を使用

スピーチtoスピーチ変換に特化しています。

次のステップ