# 音声抽出

> 録音から背景ノイズ、音楽、その他の音を取り除き、声だけを残します。文字起こし、リップシンク、吹き替え、声の変換の前に、オーディオをクリーンにします。

Source: https://nodaro.ai/ja/docs/nodes/audio/voice-extractor

**音声抽出**（Voice Extractor）ノードは、録音から背景ノイズ、音楽、その他の音を取り除き、声だけを返します。ElevenLabs の音声分離機能を使い、調整する設定はありません。ボイス系、リップシンク、文字起こしのノードの前に置いてください。これらのノードは、どれもクリーンな音声のほうがうまく動作します。

- Found in: Audio › Clean & Separate
- Output: audio
- API type: `audio-isolation`

## 使いどころ
- 編集する前に、インタビューやフィールド録音をクリーンにします。
- [**文字起こし**（Transcribe）](https://nodaro.ai/docs/nodes/audio/transcribe)の前にノイズの多いオーディオをクリーンにして、文字起こしの精度を上げます。
- 声を変換する前に、音楽やミックスされたオーディオからボーカルを取り出します。
- ポッドキャストの録音から背景ノイズを取り除きます。
- [**吹き替え**（Dubbing）](https://nodaro.ai/docs/nodes/audio/dubbing)の前に、動画のセリフを分離します。

## クイックスタート
### ノードを追加する
キャンバス上で Tab を押し、**オーディオ › クリーンアップと分離 › 音声抽出**を選びます。

### 録音を接続する
[**オーディオアップロード**（Upload Audio）](https://nodaro.ai/docs/nodes/audio/upload-audio)などのオーディオノードを、**オーディオ**入力に接続します。動画の音声を使うには、先に動画を[**オーディオを抽出**（Extract Audio）](https://nodaro.ai/docs/nodes/video/extract-audio)に通します。

### 実行する
ノードの**実行**をクリックします。クリーンになった声が、プレーヤー付きでノードに表示されます。

Workflow: ノイズの多いインタビューを、文字起こしの前にクリーンにします。

- オーディオアップロード → 音声抽出 (オーディオ)
- 音声抽出 → 文字起こし (オーディオ)

## 入力と出力
| 入力 | 接続できるノード | 説明 |
| --- | --- | --- |
| **オーディオ** | オーディオアップロード、**リファレンスオーディオ**（Reference Audio）、**テキストから音声**（Text to Speech）などのオーディオ系ノード | クリーンにする録音です。 |

出力の**オーディオ**は、声だけになったクリーンな録音です。これはデータではなくオーディオです。単語のタイミングが必要な場合は、[文字起こし](https://nodaro.ai/docs/nodes/audio/transcribe)か[**強制アライメント**（Forced Alignment）](https://nodaro.ai/docs/nodes/audio/forced-alignment)を使います。

## 設定
音声抽出には、キャンバスに表示される名前である**ラベル**以外に、設定はありません。

## モデル
| Model | Maker | Modes | Credits | Details |
| --- | --- | --- | --- | --- |
| [ElevenLabs Voice Isolation](https://nodaro.ai/docs/models/audio/elevenlabs-voice-isolation) | ElevenLabs | Voice isolation | 74 | Strip background noise / music from a vocal track. |

## クリーンアップ用ノードの選び方
| 目的 | 使うノード |
| --- | --- |
| ノイズと音楽を取り除いた、クリーンな声だけ | 音声抽出 |
| 任意の曲のボーカルとインストゥルメンタル（2 つのトラック） | [**音源分離**（Audio Separation）](https://nodaro.ai/docs/nodes/audio/audio-separation)の「ボーカル／インストゥルメンタル」モード |
| ドラム、ベース、ピアノなどの個別のステム | [音源分離](https://nodaro.ai/docs/nodes/audio/audio-separation)の「フルステム」モード |
| Suno で作った曲のボーカルとステム | [**Suno 音源分離**（Suno Separate）](https://nodaro.ai/docs/nodes/audio/suno-separate) |

## ヒント
- **先にトリミングする**：このノードは常に入力全体を処理します。クリーンにする前に、[**オーディオのトリミング**（Trim Audio）](https://nodaro.ai/docs/nodes/audio/trim-audio)で必要な部分を切り出します。
- **声を扱う前にクリーンにする**：背景ノイズが結果に持ち込まれないように、音声抽出を[**ボイスチェンジャー**（Voice Changer）](https://nodaro.ai/docs/nodes/audio/voice-changer)や[**リップシンク**（Lip Sync）](https://nodaro.ai/docs/nodes/video/lip-sync)の前に置きます。
- **埋もれた音声には限界がある**：結果は入力によって変わります。ノイズの奥深くに埋もれた音声は、アーティファクトが残ることがあります。

## API から
`POST /v1/audio-isolation` は `audioUrl` を受け取ります。MCP ツールは `audio_isolation` です。[音声とメディア](https://nodaro.ai/docs/developers/api/voice-and-media)を参照してください。

## Frequently asked questions

### 音声抽出は何をするノードですか？

録音から背景ノイズ、音楽、その他の話し声以外の音を取り除き、声だけを返します。設定がないため、オーディオを接続して実行するだけです。

### 録音の一部だけをクリーンにできますか？

音声抽出は、常に入力全体を処理します。一部だけをクリーンにするには、先にオーディオのトリミングでその部分を切り出し、トリミングしたオーディオを音声抽出に接続します。

### 音声抽出と音源分離の違いは何ですか？

音声抽出は、クリーンな声だけを残し、それ以外はすべて捨てます。音源分離は、どんなオーディオでもボーカルトラックとインストゥルメンタルトラック、またはドラムやベースなどのステムに分けるため、すべてのパートが残ります。

### ボーカルのない音楽にも、音声抽出は使えますか？

抽出するには、話し声か歌声が必要です。インストゥルメンタルだけのオーディオからは、ほとんど何も返りません。
