ボイスデザイン
文章による説明から新しいボイスを作成します。モデル、ラウドネス、ガイダンス、シードを調整でき、オーディオのプレビューと、保存して再利用できるボイス ID を受け取れます。
ボイスデザイン(Voice Design)ノードは、文章による説明から新しいボイスを作成します。ボイスを説明し、話させるテキストを渡すと、ノードは新しいボイスのオーディオプレビューと、そのボイスの ID を返します。ボイスリミックス(Voice Remix)とは異なり、モデル、ラウドネス、ガイダンス、シード、品質を調整できるため、ボイスを磨き上げて再現できます。
使いどころ
- プロジェクト全体で再現できる設定で、ブランドのボイスを作りたいとき。
- 年齢、アクセント、トーン、話し方など、特定の特徴を持つキャラクターのボイスを作りたいとき。
- 設定を 1 つずつ変えながら、ボイスを段階的に磨き上げたいとき。
- プレビューだけでなく、保存しておけるボイス ID がほしいとき。
クイックスタート
ノードを追加する
キャンバス上で Tab を押し、オーディオ › ボイス › ボイスデザインを選びます。
ボイスを説明する
設定パネルを開き、ボイスの説明を書きます。たとえば、「A warm, deep male voice with a British accent and a calm delivery.」のように書きます。
プレビュー用テキストを書く
プレビュー用テキストに、100〜1,000 文字のテキストを書きます。プレビューでは、新しいボイスがこのテキストを話します。テキストノードをプロンプト入力に接続して、テキストを渡すこともできます。
実行する
ノードの実行をクリックします。プレビューがプレーヤー付きでノードに表示され、その下にボイス ID が表示されます。ボイス ID をクリックすると、コピーできます。
入力と出力
| 入力 | 接続できるノード | 説明 |
|---|---|---|
| プロンプト | テキスト(Text)、プロンプト(Prompt)などのテキスト系ノード | プレビュー用テキストです。接続すると、プレビュー用テキストの欄の代わりに使われます。 |
| オーディオスタイル | 声の特徴(Voice Character)、話し方(Voice Delivery)などのボイス系ピッカー | ピッカーの言い回しを、ボイスの説明に追加します。説明全体が 1,000 文字以内に収まるように、必要に応じて言い回しが短縮されます。 |
| 出力 | 渡す内容 |
|---|---|
| オーディオ | オーディオプレビューです。新しいボイスが、プレビュー用テキストを話します。 |
| ボイス ID | 新しいボイスの ID です。設定パネルの生成されたボイス ID にも表示されます。 |
設定
| 設定 | 説明 |
|---|---|
| ボイスの説明 | 年齢、性別、アクセント、トーン、ペース、感情を、わかりやすい言葉で書いたボイスの説明です。 |
| プレビュー用テキスト(100〜1000 文字) | プレビューで新しいボイスが話すテキストです。100〜1,000 文字で書きます。ElevenLabs v3 では、[ を入力するとオーディオタグを挿入できます。 |
| モデル | デフォルトの ElevenLabs v3(推奨)、または ElevenLabs Multilingual v2 です。 |
| ラウドネス | -1(小さい)〜1(大きい)の値です。デフォルトは 0 で、モデルの標準の音量です。 |
| ガイダンススケール | 0(創造的)〜100(厳密)の値です。デフォルトは 5 です。モデルが説明にどれだけ忠実に従うかを決めます。 |
| シード(任意) | ボイスを再現できるようにする固定の数値です。実行のたびに新しいボイスにするには、空欄のままにします。 |
| 品質(任意) | 値を高くすると品質が上がり、バリエーションは減ります。モデルのデフォルトを使うには、空欄のままにします。 |
| 音質を向上 | 生成後に、プレビューのオーディオをクリーンにします。デフォルトはオフです。 |
| 前後のテキスト | 説明の前後に必ず追加されるテキストです。ワークフローをアプリとして使う人には表示されません。プロンプトの前後のテキストを参照してください。 |
モデル
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|---|---|---|---|
| ElevenLabs Voice Design | ElevenLabs | ボイスデザイン | 50 | 説明文から合成ボイスをデザインします(リファレンスのクリップは不要です)。 |
最高の品質と最も幅広い言語サポートを得るには、デフォルトの ElevenLabs v3 を使います。ElevenLabs Multilingual v2 に切り替えるのは、特定のボイスで v3 が予想外の結果になったときだけにしてください。
良い説明の書き方
- 具体的な特徴を挙げる:「a cool, interesting voice」よりも、「Gravelly baritone, speaks slowly, sounds like a late-night radio host」のほうがうまくいきます。
- 基本を押さえる:年齢層、性別、アクセント、トーン、ペース、感情の質を含めます。
- プレビュー用テキストを最終的な用途に合わせる:最終的なコンテンツと同じスタイルでプレビュー用テキストを書くと、実際に使うときと同じようにボイスを聞けます。
ボイスを保存して再利用する
- シードを固定する:気に入ったボイスができたら、そのシード、説明、モデルを書き留めておきます。どれか 1 つでも変えると、ボイスが変わることがあります。
- ボイス ID をコピーする:実行後、ボイス ID がノード上と、設定パネルの生成されたボイス ID に表示されます。ノード上の ID をクリックすると、コピーできます。
- 複数のボイスの音量をそろえる:ラウドネスを使って、デザインしたボイスの音量を同じレベルにそろえます。
ボイスデザインとボイスリミックスの使い分け
| ボイスデザイン | ボイスリミックス | |
|---|---|---|
| 調整できる項目 | モデル、ラウドネス、ガイダンス、シード、品質、音質の向上 | 説明とプレビュー用テキストのみ |
| 出力 | オーディオプレビューとボイス ID | オーディオプレビュー |
| 向いている用途 | 保存して再現したいボイス | ボイスのアイデアをすばやく探ること |
ヒント
- ガイダンススケールは 5 から始める:説明が具体的で正確な場合は、20〜30 程度まで上げます。より自由で自然なボイスにするには、1〜2 程度まで下げます。値が高すぎると、品質が下がることがあります。
- 試行錯誤の間は「音質を向上」をオフにしておく:処理時間が増えるため、オンにするのは最後の実行のときにします。
- まずボイスリミックスで試す:ボイスリミックスでアイデアをすばやく試し、一番良いものを、ここですべての設定を使って作り直します。
API から
POST /v1/voice-design は、text(プレビュー用テキスト)と voiceDescription を受け取り、任意で model、loudness、guidanceScale、seed、quality、shouldEnhance も指定できます。MCP ツールは voice_design です。音声とメディアを参照してください。
よくある質問
関連ページ
ボイスリミックス
テキストから音声
声の特徴
話し方
ElevenLabs Voice Design
最終更新