Nodaro ドキュメント
ドキュメントノードリファレンスモデルAI エージェント(MCP)開発者向けセルフホスティングリサーチ
オーディオ

ボイスデザイン

文章による説明から新しいボイスを作成します。モデル、ラウドネス、ガイダンス、シードを調整でき、オーディオのプレビューと、保存して再利用できるボイス ID を受け取れます。

ボイスデザイン(Voice Design)ノードは、文章による説明から新しいボイスを作成します。ボイスを説明し、話させるテキストを渡すと、ノードは新しいボイスのオーディオプレビューと、そのボイスの ID を返します。ボイスリミックス(Voice Remix)とは異なり、モデル、ラウドネス、ガイダンス、シード、品質を調整できるため、ボイスを磨き上げて再現できます。

使いどころ

  • プロジェクト全体で再現できる設定で、ブランドのボイスを作りたいとき。
  • 年齢、アクセント、トーン、話し方など、特定の特徴を持つキャラクターのボイスを作りたいとき。
  • 設定を 1 つずつ変えながら、ボイスを段階的に磨き上げたいとき。
  • プレビューだけでなく、保存しておけるボイス ID がほしいとき。

クイックスタート

ノードを追加する

キャンバス上で Tab を押し、オーディオ › ボイス › ボイスデザインを選びます。

ボイスを説明する

設定パネルを開き、ボイスの説明を書きます。たとえば、「A warm, deep male voice with a British accent and a calm delivery.」のように書きます。

プレビュー用テキストを書く

プレビュー用テキストに、100〜1,000 文字のテキストを書きます。プレビューでは、新しいボイスがこのテキストを話します。テキストノードをプロンプト入力に接続して、テキストを渡すこともできます。

実行する

ノードの実行をクリックします。プレビューがプレーヤー付きでノードに表示され、その下にボイス ID が表示されます。ボイス ID をクリックすると、コピーできます。

オーディオスタイルオーディオスタイルプロンプト声の特徴年配の女性、アイルランド訛り話し方ゆっくり、温かい、語り手テキストプレビュー用のセリフボイスデザインElevenLabs v3
2 つのボイス系ピッカーがボイスを説明し、テキストノードがプレビュー用のセリフを渡し、ボイスデザインがボイスを作成します。

入力と出力

入力接続できるノード説明
プロンプトテキスト(Text)、プロンプト(Prompt)などのテキスト系ノードプレビュー用テキストです。接続すると、プレビュー用テキストの欄の代わりに使われます。
オーディオスタイル声の特徴(Voice Character)、話し方(Voice Delivery)などのボイス系ピッカーピッカーの言い回しを、ボイスの説明に追加します。説明全体が 1,000 文字以内に収まるように、必要に応じて言い回しが短縮されます。
出力渡す内容
オーディオオーディオプレビューです。新しいボイスが、プレビュー用テキストを話します。
ボイス ID新しいボイスの ID です。設定パネルの生成されたボイス ID にも表示されます。

設定

設定説明
ボイスの説明年齢、性別、アクセント、トーン、ペース、感情を、わかりやすい言葉で書いたボイスの説明です。
プレビュー用テキスト(100〜1000 文字)プレビューで新しいボイスが話すテキストです。100〜1,000 文字で書きます。ElevenLabs v3 では、[ を入力するとオーディオタグを挿入できます。
モデルデフォルトの ElevenLabs v3(推奨)、または ElevenLabs Multilingual v2 です。
ラウドネス-1(小さい)〜1(大きい)の値です。デフォルトは 0 で、モデルの標準の音量です。
ガイダンススケール0(創造的)〜100(厳密)の値です。デフォルトは 5 です。モデルが説明にどれだけ忠実に従うかを決めます。
シード(任意)ボイスを再現できるようにする固定の数値です。実行のたびに新しいボイスにするには、空欄のままにします。
品質(任意)値を高くすると品質が上がり、バリエーションは減ります。モデルのデフォルトを使うには、空欄のままにします。
音質を向上生成後に、プレビューのオーディオをクリーンにします。デフォルトはオフです。
前後のテキスト説明の前後に必ず追加されるテキストです。ワークフローをアプリとして使う人には表示されません。プロンプトの前後のテキストを参照してください。

モデル

モデル開発元モードクレジット詳細
ElevenLabs Voice DesignElevenLabsボイスデザイン50説明文から合成ボイスをデザインします(リファレンスのクリップは不要です)。

最高の品質と最も幅広い言語サポートを得るには、デフォルトの ElevenLabs v3 を使います。ElevenLabs Multilingual v2 に切り替えるのは、特定のボイスで v3 が予想外の結果になったときだけにしてください。

良い説明の書き方

  • 具体的な特徴を挙げる:「a cool, interesting voice」よりも、「Gravelly baritone, speaks slowly, sounds like a late-night radio host」のほうがうまくいきます。
  • 基本を押さえる:年齢層、性別、アクセント、トーン、ペース、感情の質を含めます。
  • プレビュー用テキストを最終的な用途に合わせる:最終的なコンテンツと同じスタイルでプレビュー用テキストを書くと、実際に使うときと同じようにボイスを聞けます。

ボイスを保存して再利用する

  • シードを固定する:気に入ったボイスができたら、そのシード、説明、モデルを書き留めておきます。どれか 1 つでも変えると、ボイスが変わることがあります。
  • ボイス ID をコピーする:実行後、ボイス ID がノード上と、設定パネルの生成されたボイス ID に表示されます。ノード上の ID をクリックすると、コピーできます。
  • 複数のボイスの音量をそろえる:ラウドネスを使って、デザインしたボイスの音量を同じレベルにそろえます。

ボイスデザインとボイスリミックスの使い分け

ボイスデザインボイスリミックス
調整できる項目モデル、ラウドネス、ガイダンス、シード、品質、音質の向上説明とプレビュー用テキストのみ
出力オーディオプレビューとボイス IDオーディオプレビュー
向いている用途保存して再現したいボイスボイスのアイデアをすばやく探ること

ヒント

  • ガイダンススケールは 5 から始める:説明が具体的で正確な場合は、20〜30 程度まで上げます。より自由で自然なボイスにするには、1〜2 程度まで下げます。値が高すぎると、品質が下がることがあります。
  • 試行錯誤の間は「音質を向上」をオフにしておく:処理時間が増えるため、オンにするのは最後の実行のときにします。
  • まずボイスリミックスで試す:ボイスリミックスでアイデアをすばやく試し、一番良いものを、ここですべての設定を使って作り直します。

API から

POST /v1/voice-design は、text(プレビュー用テキスト)と voiceDescription を受け取り、任意で model、loudness、guidanceScale、seed、quality、shouldEnhance も指定できます。MCP ツールは voice_design です。音声とメディアを参照してください。

よくある質問

最終更新

目次