# テキストからオーディオ

> ElevenLabs Sound Effects で、テキストの説明から効果音や環境音を最長 22 秒まで生成します。背景音には、つなぎ目のないループも作れます。

Source: https://nodaro.ai/ja/docs/nodes/audio/text-to-audio

**テキストからオーディオ**（Text to Audio）ノードは、テキストの説明から効果音や環境音を生成します。使うモデルは ElevenLabs Sound Effects です。音を説明して長さを設定すると、ノードがオーディオクリップを返します。雨や人混みのざわめきなど、つなぎ目なく繰り返す背景音には、**ループ**をオンにします。

- Found in: Audio › Sound Effects
- Output: audio
- API type: `text-to-audio`

## 使いどころ
- 動画用の効果音。足音、ドアの音、衝撃音などです。
- 背景の環境音。森、街の通り、海などです。
- UI の操作音や通知音。
- ポッドキャストや動画の下に敷く、途切れずに繰り返すループ音。
- モーショングラフィックス用のサウンドテクスチャ。

既存の動画に合う音を 1 ステップで追加するには、[**動画の効果音**（Video SFX）](https://nodaro.ai/docs/nodes/video/video-sfx)を使います。

## クイックスタート
### ノードを追加する
キャンバス上で Tab を押し、**オーディオ › 効果音 › テキストからオーディオ**を選びます。

### 音を説明する
設定パネルを開き、**プロンプト**を書きます。たとえば「heavy rain on a tin roof」です。音にまつわるストーリーではなく、音そのものを説明します。

### 長さを設定する
**長さ（秒）**を 0.5〜22 の範囲で設定します。繰り返す背景音にする場合は、**ループ**を**オン（シームレスループ）**にします。

### 実行する
ノードの**実行**をクリックします。生成された音が、プレーヤー付きでノードに表示されます。

Workflow: 生成した 2 つの音を 1 つのサウンドスケープにミックスし、動画に結合します。

- テキストからオーディオ → オーディオをミックス (オーディオ)
- テキストからオーディオ → オーディオをミックス (オーディオ)
- オーディオをミックス → 動画とオーディオを結合 (オーディオ)
- 動画生成 → 動画とオーディオを結合 (動画)

## 入力
| 入力 | 接続できるノード | 説明 |
| --- | --- | --- |
| **プロンプト** | **テキスト**（Text）や**プロンプト**（Prompt）などのテキスト系ノード | **プロンプト**欄の代わりに使う、音の説明です。 |
| **オーディオスタイル** | **音楽のムード**（Music Mood）や**トーン**（Tone）などのオーディオ系ピッカー | ピッカーの言葉を説明に追加します。 |

出力の**オーディオ**は、生成された音の URL です。

## 設定
| 設定 | 説明 |
| --- | --- |
| **プロンプト** | 音の説明で、最大 450 文字です。 |
| **プロバイダー** | 効果音のモデルです。選べるのは **ElevenLabs SFX v2** だけです。 |
| **長さ（秒）** | 0.5〜22 秒で、0.5 秒単位です。デフォルトは 10 です。 |
| **ループ** | **オフ**（デフォルト）または**オン（シームレスループ）**です。オンにすると、終わりが始まりに途切れなくつながるクリップを作ります。 |
| **プロンプトの影響度** | 0（よりランダム）〜1（より忠実）です。デフォルトは 0.3 です。モデルが説明にどれだけ忠実に従うかを決めます。 |
| **前後のテキスト** | 説明の前後に必ず追加されるテキストです。ワークフローをアプリとして使う人には表示されません。[プロンプトの前後のテキスト](https://nodaro.ai/docs/concepts/prompt-pre-post-text)を参照してください。 |

## モデル
| Model | Maker | Modes | Credits | Details |
| --- | --- | --- | --- | --- |
| [ElevenLabs Sound Effects](https://nodaro.ai/docs/models/audio/elevenlabs-sound-effects) | ElevenLabs | Sound effects | 3 | Generate short sound effects from a text prompt. |

料金は生成 1 回ごとです。**長さ（秒）**によって料金は変わりません。

## ヒント
- **シーンではなく音を説明する**：「it was a stormy night」よりも、「Heavy rain on a tin roof」のほうがうまくいきます。
- **プロンプトの影響度は低めにする**：0.2〜0.4 の値が、最も自然に聞こえます。結果が説明から離れる場合にだけ、値を上げてください。
- **連続する音をループする**：ループは、風、雨、人混みのざわめきなど、一定に続く環境音に最も向いています。1 回きりの打撃音には、あまり向いていません。
- **重ねてからミックスする**：サウンドスケープの各パーツをそれぞれ別のノードで生成し、[**オーディオをミックス**（Mix Audio）](https://nodaro.ai/docs/nodes/audio/mix-audio)でまとめて、それぞれの音量を設定します。

## API から
MCP ツールは `text_to_audio` です。[MCP ツール](https://nodaro.ai/docs/mcp/tools)を参照してください。

## Frequently asked questions

### 生成できる効果音の長さは、どれくらいですか？

0.5〜22 秒で、0.5 秒単位で指定できます。デフォルトは 10 秒です。もっと長い背景音が必要な場合は、「ループ」をオンにしてクリップを繰り返します。

### 説明は、どれくらいの長さまで書けますか？

最大 450 文字です。音は 1 つずつ説明し、複雑なサウンドスケープは、複数のノードの音をミックスして組み立てます。

### 長い音ほど、料金は高くなりますか？

いいえ。料金は生成 1 回ごとに決まり、「長さ」の設定によって変わることはありません。

### 「テキストからオーディオ」で、音声や音楽を作れますか？

このノードは効果音と環境音のためのもので、音声向けではありません。音声には「テキストから音声」を使います。音楽には「Suno 生成」か「音楽生成」を使います。

### 「プロンプトの影響度」は何を決める設定ですか？

モデルが説明にどれだけ忠実に従うかを、0〜1 で設定します。デフォルトは 0.3 です。値が低いほど、自由に解釈されます。結果が説明から離れすぎる場合にだけ、値を上げてください。
