オーディオ
ボイスリミックス
ボイスをわかりやすい言葉で説明し、プレビュー用テキストを話す声を聞けます。リファレンスの録音も調整する設定も不要な、ボイスのアイデアを手早く探す方法です。
ボイスリミックス(Voice Remix)ノードは、わかりやすい言葉で書いた説明からボイスを作成します。そのボイスがプレビュー用テキストを話すのを聞けます。ボイスのアイデアを手早く探すための方法で、リファレンスの録音も設定も必要ありません。磨き上げて再現し、保存できるボイスがほしい場合は、ボイスデザイン(Voice Design)を使います。
使いどころ
- プロジェクトのボイスを決める前に、いくつかのボイスのスタイルを試します。
- 文章による説明から、キャラクターのボイスを聞いてみます。
- 制作に入る前に、クライアントの承認を得るためのボイスのサンプルを作ります。
- オーディオブックや動画のナレーターのスタイルを、ブレインストーミングします。
クイックスタート
ノードを追加する
キャンバス上で Tab を押し、オーディオ › ボイス › ボイスリミックスを選びます。
ボイスを説明する
設定パネルを開き、ボイスの説明を書きます。たとえば、「A warm, deep male voice with a slight British accent and a calm delivery.」のように書きます。
プレビュー用テキストを書く
プレビュー用テキストに、ボイスに話させる文を 1〜2 文ほど書きます。
実行する
ノードの実行をクリックし、ノード上でプレビューを聞きます。
入力と出力
| 入力 | 接続できるノード | 説明 |
|---|---|---|
| オーディオスタイル | 声の特徴(Voice Character)、話し方(Voice Delivery)などのボイス系ピッカー | 設定パネルに、接続したピッカーの一覧と、ピッカーの言い回しを含む最終的なボイスの説明が表示されます。 |
出力のオーディオはオーディオプレビューで、新しいボイスがプレビュー用テキストを話します。
設定
| 設定 | 説明 |
|---|---|
| ボイスの説明 | 年齢、性別、アクセント、トーン、ペース、感情を、わかりやすい言葉で書いたボイスの説明です。 |
| プレビュー用テキスト | プレビューで新しいボイスが話すテキストです。実行するには、プレビュー用テキストが必要です。 |
| 前後のテキスト | 説明の前後に必ず追加されるテキストです。ワークフローをアプリとして使う人には表示されません。プロンプトの前後のテキストを参照してください。 |
ヒント
- 具体的に書く:年齢層、性別、アクセント、トーン、ペース、感情の質を含めます。言い回しを少し変えるだけで、はっきりと違うボイスになることがあります。
- 現実的なプレビュー用テキストを使う:単語を並べるよりも、自然な話し言葉で 1〜2 文ほど書いたほうが、ボイスの特徴がよくわかります。
- 複数回実行する:同じ説明でも、実行のたびに少し違うボイスになることがあります。
- ボイスを残すならボイスデザインに移る:ボイスリミックスが返すのはプレビューだけです。ボイスデザインはボイス ID を返し、シードを固定することもできます。
- ボイスを録音に適用する:気に入ったボイスのスタイルが見つかったら、ボイスチェンジャー(Voice Changer)を使って、そのスタイルに合うボイスを既存の録音に適用します。
API から
POST /v1/voice-remix は、text(プレビュー用テキスト)と voiceDescription を受け取ります。MCP ツールは voice_remix です。音声とメディアを参照してください。
よくある質問
関連ページ
ボイスデザイン
文章による説明から新しいボイスを作成します。モデル、ラウドネス、ガイダンス、シードを調整でき、オーディオのプレビューと、保存して再利用できるボイス ID を受け取れます。
ボイスチェンジャー
録音や話している動画の声を別の声に置き換え、元の感情、テンポ、タイミングはそのまま保ちます。ElevenLabs による音声から音声への変換です。
テキストから音声
ElevenLabs v3、Turbo v2.5、Multilingual v2 で、テキストを自然な音声にします。ボイスを選び、オーディオタグで感情を加え、最大 46 の言語で読み上げます。
声の特徴
デザインするボイスがどんな人物の声かを、年齢、性別、最大 3 つの言語、45 種類から選ぶアクセント、音色で説明します。Nodaro が、それをボイスデザインのボイスの説明に追加します。
最終更新