# ボイスデザイン

> 文章による説明から新しいボイスを作成します。モデル、ラウドネス、ガイダンス、シードを調整でき、オーディオのプレビューと、保存して再利用できるボイス ID を受け取れます。

Source: https://nodaro.ai/ja/docs/nodes/audio/voice-design

**ボイスデザイン**（Voice Design）ノードは、文章による説明から新しいボイスを作成します。ボイスを説明し、話させるテキストを渡すと、ノードは新しいボイスのオーディオプレビューと、そのボイスの ID を返します。[**ボイスリミックス**（Voice Remix）](https://nodaro.ai/docs/nodes/audio/voice-remix)とは異なり、モデル、ラウドネス、ガイダンス、シード、品質を調整できるため、ボイスを磨き上げて再現できます。

- Found in: Audio › Voices
- Output: audio
- API type: `voice-design`

## 使いどころ
- プロジェクト全体で再現できる設定で、ブランドのボイスを作りたいとき。
- 年齢、アクセント、トーン、話し方など、特定の特徴を持つキャラクターのボイスを作りたいとき。
- 設定を 1 つずつ変えながら、ボイスを段階的に磨き上げたいとき。
- プレビューだけでなく、保存しておけるボイス ID がほしいとき。

## クイックスタート
### ノードを追加する
キャンバス上で Tab を押し、**オーディオ › ボイス › ボイスデザイン**を選びます。

### ボイスを説明する
設定パネルを開き、**ボイスの説明**を書きます。たとえば、「A warm, deep male voice with a British accent and a calm delivery.」のように書きます。

### プレビュー用テキストを書く
**プレビュー用テキスト**に、100〜1,000 文字のテキストを書きます。プレビューでは、新しいボイスがこのテキストを話します。テキストノードを**プロンプト**入力に接続して、テキストを渡すこともできます。

### 実行する
ノードの**実行**をクリックします。プレビューがプレーヤー付きでノードに表示され、その下にボイス ID が表示されます。ボイス ID をクリックすると、コピーできます。

Workflow: 2 つのボイス系ピッカーがボイスを説明し、テキストノードがプレビュー用のセリフを渡し、ボイスデザインがボイスを作成します。

- 声の特徴 → ボイスデザイン (オーディオスタイル)
- 話し方 → ボイスデザイン (オーディオスタイル)
- テキスト → ボイスデザイン (プロンプト)

## 入力と出力
| 入力 | 接続できるノード | 説明 |
| --- | --- | --- |
| **プロンプト** | **テキスト**（Text）、**プロンプト**（Prompt）などのテキスト系ノード | プレビュー用テキストです。接続すると、プレビュー用テキストの欄の代わりに使われます。 |
| **オーディオスタイル** | **声の特徴**（Voice Character）、**話し方**（Voice Delivery）などのボイス系ピッカー | ピッカーの言い回しを、ボイスの説明に追加します。説明全体が 1,000 文字以内に収まるように、必要に応じて言い回しが短縮されます。 |

| 出力 | 渡す内容 |
| --- | --- |
| **オーディオ** | オーディオプレビューです。新しいボイスが、プレビュー用テキストを話します。 |
| **ボイス ID** | 新しいボイスの ID です。設定パネルの**生成されたボイス ID** にも表示されます。 |

## 設定
| 設定 | 説明 |
| --- | --- |
| **ボイスの説明** | 年齢、性別、アクセント、トーン、ペース、感情を、わかりやすい言葉で書いたボイスの説明です。 |
| **プレビュー用テキスト（100〜1000 文字）** | プレビューで新しいボイスが話すテキストです。100〜1,000 文字で書きます。ElevenLabs v3 では、`[` を入力するとオーディオタグを挿入できます。 |
| **モデル** | デフォルトの **ElevenLabs v3（推奨）**、または **ElevenLabs Multilingual v2** です。 |
| **ラウドネス** | -1（小さい）〜1（大きい）の値です。デフォルトは 0 で、モデルの標準の音量です。 |
| **ガイダンススケール** | 0（創造的）〜100（厳密）の値です。デフォルトは 5 です。モデルが説明にどれだけ忠実に従うかを決めます。 |
| **シード（任意）** | ボイスを再現できるようにする固定の数値です。実行のたびに新しいボイスにするには、空欄のままにします。 |
| **品質（任意）** | 値を高くすると品質が上がり、バリエーションは減ります。モデルのデフォルトを使うには、空欄のままにします。 |
| **音質を向上** | 生成後に、プレビューのオーディオをクリーンにします。デフォルトはオフです。 |
| **前後のテキスト** | 説明の前後に必ず追加されるテキストです。ワークフローをアプリとして使う人には表示されません。[プロンプトの前後のテキスト](https://nodaro.ai/docs/concepts/prompt-pre-post-text)を参照してください。 |

## モデル
| Model | Maker | Modes | Credits | Details |
| --- | --- | --- | --- | --- |
| [ElevenLabs Voice Design](https://nodaro.ai/docs/models/audio/elevenlabs-voice-design) | ElevenLabs | Voice design | 50 | Design a synthetic voice from a description (no reference clip needed). |

最高の品質と最も幅広い言語サポートを得るには、デフォルトの **ElevenLabs v3** を使います。**ElevenLabs Multilingual v2** に切り替えるのは、特定のボイスで v3 が予想外の結果になったときだけにしてください。

## 良い説明の書き方
- **具体的な特徴を挙げる**：「a cool, interesting voice」よりも、「Gravelly baritone, speaks slowly, sounds like a late-night radio host」のほうがうまくいきます。
- **基本を押さえる**：年齢層、性別、アクセント、トーン、ペース、感情の質を含めます。
- **プレビュー用テキストを最終的な用途に合わせる**：最終的なコンテンツと同じスタイルでプレビュー用テキストを書くと、実際に使うときと同じようにボイスを聞けます。

## ボイスを保存して再利用する
- **シードを固定する**：気に入ったボイスができたら、その**シード**、説明、モデルを書き留めておきます。どれか 1 つでも変えると、ボイスが変わることがあります。
- **ボイス ID をコピーする**：実行後、ボイス ID がノード上と、設定パネルの**生成されたボイス ID** に表示されます。ノード上の ID をクリックすると、コピーできます。
- **複数のボイスの音量をそろえる**：**ラウドネス**を使って、デザインしたボイスの音量を同じレベルにそろえます。

## ボイスデザインとボイスリミックスの使い分け
| | ボイスデザイン | [ボイスリミックス](https://nodaro.ai/docs/nodes/audio/voice-remix) |
| --- | --- | --- |
| **調整できる項目** | モデル、ラウドネス、ガイダンス、シード、品質、音質の向上 | 説明とプレビュー用テキストのみ |
| **出力** | オーディオプレビューとボイス ID | オーディオプレビュー |
| **向いている用途** | 保存して再現したいボイス | ボイスのアイデアをすばやく探ること |

## ヒント
- **ガイダンススケールは 5 から始める**：説明が具体的で正確な場合は、20〜30 程度まで上げます。より自由で自然なボイスにするには、1〜2 程度まで下げます。値が高すぎると、品質が下がることがあります。
- **試行錯誤の間は「音質を向上」をオフにしておく**：処理時間が増えるため、オンにするのは最後の実行のときにします。
- **まずボイスリミックスで試す**：[ボイスリミックス](https://nodaro.ai/docs/nodes/audio/voice-remix)でアイデアをすばやく試し、一番良いものを、ここですべての設定を使って作り直します。

## API から
`POST /v1/voice-design` は、`text`（プレビュー用テキスト）と `voiceDescription` を受け取り、任意で `model`、`loudness`、`guidanceScale`、`seed`、`quality`、`shouldEnhance` も指定できます。MCP ツールは `voice_design` です。[音声とメディア](https://nodaro.ai/docs/developers/api/voice-and-media)を参照してください。

## Frequently asked questions

### ボイスデザインとボイスリミックスの違いは何ですか？

どちらも、文章による説明からボイスを作成します。ボイスデザインには、モデル、ラウドネス、ガイダンス、シード、品質の調整項目があり、ボイス ID も返します。ボイスリミックスは手軽な版で、指定するのは説明とプレビュー用テキストだけです。

### プレビュー用テキストは、どのくらいの長さが必要ですか？

100〜1,000 文字です。さまざまな音や文の形でボイスを確かめられるだけの量を書いてください。たとえば、自然な文を 2〜3 文ほど書きます。

### 同じボイスをもう一度得るにはどうすればよいですか？

気に入ったボイスが見つかったら、シードを設定します。シード、説明、モデルが同じなら、同じボイスがもう一度得られるはずです。どれか 1 つでも設定を変えると、シードが同じでも別のボイスになることがあります。

### ガイダンススケールは何をする設定ですか？

モデルが説明にどれだけ厳密に従うかを決めます。デフォルトは 5 です。説明が具体的で正確な場合は 20〜30 程度まで上げ、より自然な結果にするには 1〜2 程度まで下げます。

### 言葉の代わりに、ピッカーでボイスを説明できますか？

はい。年齢、性別、言語、アクセント、音色を指定する「声の特徴」ピッカーや、ペース、感情、アーキタイプを指定する「話し方」ピッカーを、「オーディオスタイル」入力に接続します。ピッカーの言い回しが、説明に追加されます。
