オーディオ
音声抽出
録音から背景ノイズ、音楽、その他の音を取り除き、声だけを残します。文字起こし、リップシンク、吹き替え、声の変換の前に、オーディオをクリーンにします。
音声抽出(Voice Extractor)ノードは、録音から背景ノイズ、音楽、その他の音を取り除き、声だけを返します。ElevenLabs の音声分離機能を使い、調整する設定はありません。ボイス系、リップシンク、文字起こしのノードの前に置いてください。これらのノードは、どれもクリーンな音声のほうがうまく動作します。
使いどころ
- 編集する前に、インタビューやフィールド録音をクリーンにします。
- 文字起こし(Transcribe)の前にノイズの多いオーディオをクリーンにして、文字起こしの精度を上げます。
- 声を変換する前に、音楽やミックスされたオーディオからボーカルを取り出します。
- ポッドキャストの録音から背景ノイズを取り除きます。
- 吹き替え(Dubbing)の前に、動画のセリフを分離します。
クイックスタート
ノードを追加する
キャンバス上で Tab を押し、オーディオ › クリーンアップと分離 › 音声抽出を選びます。
録音を接続する
オーディオアップロード(Upload Audio)などのオーディオノードを、オーディオ入力に接続します。動画の音声を使うには、先に動画をオーディオを抽出(Extract Audio)に通します。
実行する
ノードの実行をクリックします。クリーンになった声が、プレーヤー付きでノードに表示されます。
入力と出力
| 入力 | 接続できるノード | 説明 |
|---|---|---|
| オーディオ | オーディオアップロード、リファレンスオーディオ(Reference Audio)、テキストから音声(Text to Speech)などのオーディオ系ノード | クリーンにする録音です。 |
出力のオーディオは、声だけになったクリーンな録音です。これはデータではなくオーディオです。単語のタイミングが必要な場合は、文字起こしか強制アライメント(Forced Alignment)を使います。
設定
音声抽出には、キャンバスに表示される名前であるラベル以外に、設定はありません。
モデル
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|---|---|---|---|
| ElevenLabs Voice Isolation | ElevenLabs | 音声の分離 | 74 | ボーカルトラックから、背景のノイズや音楽を取り除きます。 |
クリーンアップ用ノードの選び方
| 目的 | 使うノード |
|---|---|
| ノイズと音楽を取り除いた、クリーンな声だけ | 音声抽出 |
| 任意の曲のボーカルとインストゥルメンタル(2 つのトラック) | 音源分離(Audio Separation)の「ボーカル/インストゥルメンタル」モード |
| ドラム、ベース、ピアノなどの個別のステム | 音源分離の「フルステム」モード |
| Suno で作った曲のボーカルとステム | Suno 音源分離(Suno Separate) |
ヒント
- 先にトリミングする:このノードは常に入力全体を処理します。クリーンにする前に、オーディオのトリミング(Trim Audio)で必要な部分を切り出します。
- 声を扱う前にクリーンにする:背景ノイズが結果に持ち込まれないように、音声抽出をボイスチェンジャー(Voice Changer)やリップシンク(Lip Sync)の前に置きます。
- 埋もれた音声には限界がある:結果は入力によって変わります。ノイズの奥深くに埋もれた音声は、アーティファクトが残ることがあります。
API から
POST /v1/audio-isolation は audioUrl を受け取ります。MCP ツールは audio_isolation です。音声とメディアを参照してください。
よくある質問
関連ページ
音源分離
Demucs モデルで、あらゆるオーディオをボーカルとインストゥルメンタル、またはドラム、ベース、ギター、ピアノなどのステムに分離します。どこで作られた曲にも使えます。
文字起こし
ElevenLabs STT または Whisper で、オーディオや動画の音声をテキストにします。字幕用の単語のタイミング、話者のラベル、音楽や笑い声のタグも取得できます。
ボイスチェンジャー
録音や話している動画の声を別の声に置き換え、元の感情、テンポ、タイミングはそのまま保ちます。ElevenLabs による音声から音声への変換です。
オーディオのトリミング
開始時間と終了時間を指定してオーディオファイルの一部を切り出し、MP3、WAV、AAC で保存します。録音や曲のうち、次のノードに必要な部分だけを残せます。
ElevenLabs Voice Isolation
ElevenLabs Voice Isolation は、Nodaro で使える ElevenLabs のオーディオモデルです。対応するモードは音声の分離です。1 回の実行は 74 クレジットからです。
最終更新