音声

ElevenLabsで音声を作成、カスタマイズ、管理する方法を学びましょう。

概要

ElevenLabsは、音声作成とカスタマイズのためのモデルを提供しています。プラットフォームでは、豊富なボイスライブラリの音声、ボイスクローン、テキストプロンプトで作成する生成音声など、幅広い音声オプションを利用できます。

音声の種類

  • コミュニティ:ElevenLabsのボイスライブラリでコミュニティが共有した音声。
  • クローン:インスタントボイスクローンまたはプロフェッショナルボイスクローンで作成したカスタム音声。
  • ボイスデザイン:ボイスデザインツールで作成した生成音声。

デフォルト音声は、永続的に利用できる新しい音声へ順次置き換えられます。 すべてのデフォルト音声は2026年12月31日に期限切れとなり、この日以降は 利用できなくなります。

コミュニティ

ボイスライブラリには、ElevenLabsコミュニティが共有した10,000以上の音声があります。次のことができます:

  • ElevenLabsコミュニティが共有した個性豊かな音声を見つける。
  • 音声を個人コレクションに追加する。
  • 自分のボイスクローンを共有し、他の有料加入者が使用した際に現金報酬を受け取る。

自分の音声をコミュニティと共有し、条件を設定して、他のユーザーが使用するたびに現金報酬を獲得できます。 これまでに $14M 以上を支払いました。

無料プランのユーザーは、API経由でボイスライブラリの音声を利用できません。

クローン

短い音声サンプルからインスタントボイスクローンで自分の声をクローンすることも、プロフェッショナルボイスクローンでリアルな音声を作成することもできます。

  • インスタントボイスクローン:短い音声サンプルからすばやく音声をクローンします。
  • プロフェッショナルボイスクローン:より長い学習用音声を使って、プロ品質のボイスクローンを生成します。

プロフェッショナルボイスクローンが自分自身の音声サンプルから作成されていることを確認するために、ボイスキャプチャ技術を使用しています。

プロフェッショナルボイスクローンを作成するには、クリエイタープラン以上が必要です。

ボイスデザイン

ボイスデザインでは、年齢、性別、アクセント、トーンなどの属性を指定して、まったく新しい音声を作成できます。生成音声は、次の用途に最適です:

  • 細かな特徴を持つリアルな音声。
  • ゲームやストーリーテリング向けのクリエイティブなキャラクター音声。

ボイスデザインでは、3つの音声プレビューが作成されます。必要なのは次の情報だけです:

  • 20~1000文字の 音声説明。
  • 音声をプレビューするための、100~1000文字の任意の テキスト。
Eleven v4でのボイスデザイン

Eleven v4を使用してください。ボイスデザインの音声はこのモデルで動作しますが、以前のモデルより表現力が低くなる場合があります。Eleven v3でも、幅広い感情を表現する音声をデザインできます。

これらのモデルには、次の利点があります:

  • より自然で多用途な音声生成。
  • 音声の特性をより細かく制御。
  • プレビュー生成でのオーディオタグのサポート。
  • v2モデルとの後方互換性。

ボイスリミックス

ボイスリミックスでは、認識できる特徴を維持しながら、核となる属性を変更して所有する音声を変換できます。自然言語プロンプトで、性別、アクセント、話し方、ペース、オーディオ品質を調整できます。この機能は、異なるコンテキストへの音声の適応、キャラクターのバリエーション作成、既存の音声プロファイルのオーディオ品質向上に特に役立ちます。ボイスリミックスは、自身が所有するすべてのクローン音声(インスタントボイスクローンまたはプロフェッショナルボイスクローン)と、ボイスデザインで作成した音声で使用できます。

音声の管理

すべての音声はマイボイスで管理でき、次のことができます:

  • 音声の検索、フィルタリング、分類
  • 説明とカスタムタグの追加
  • すばやくアクセスできるように音声を整理

音声コレクションの管理方法については、マイボイスのドキュメントを参照してください。

  • 検索とフィルタリング:キーワードまたはタグで音声を探します。
  • サンプルのプレビュー:使用前に音声デモを聞けます。
  • コレクションに追加:プロジェクトで簡単にアクセスできるよう、音声を保存します。

ヒント:たとえば「Australian narration」のように、特定のアクセントやジャンルで検索してみてください。

対応言語

すべてのElevenLabs音声は複数の言語に対応しています。ElevenLabsは32言語での音声作成に対応しています。より自然な結果を得るには、対象地域に合わせて音声を選択してください。

  • 生成音声とクローン音声:アクセントの再現度は、入力サンプルまたは選択した属性によって異なります。

Multilingual v2モデルは、29言語に対応しています。

英語(米国、英国、オーストラリア、カナダ)、日本語、中国語、ドイツ語、ヒンディー語、フランス語(フランス、カナダ)、韓国語、ポルトガル語(ブラジル、ポルトガル)、イタリア語、スペイン語(スペイン、メキシコ)、インドネシア語、オランダ語、トルコ語、フィリピン語、ポーランド語、スウェーデン語、ブルガリア語、ルーマニア語、アラビア語(サウジアラビア、アラブ首長国連邦)、チェコ語、ギリシャ語、フィンランド語、クロアチア語、マレー語、スロバキア語、デンマーク語、タミル語、ウクライナ語、ロシア語。

Flash v2.5は、v2モデルのすべての言語に加え、以下を含む32言語に対応しています。

ハンガリー語、ノルウェー語、ベトナム語

モデルの詳細を見る

主なポイント

  • インスタントボイスクローン:短い音声サンプル(2分未満)から作成。ほとんどのプランで利用可能
  • プロフェッショナルボイスクローン:最高の再現度を得るには、より長い学習用音声が必要。クリエイタープラン以上が必要
  • 音声の共有:プロフェッショナルボイスクローンはボイスライブラリで公開共有できます。インスタントボイスクローンと生成音声は共有できません
  • 生成音声:ボイスデザインでテキスト説明から作成。ゲーム、アニメーション、クリエイティブなストーリーテリングにおける個性的なキャラクターに適しています