Nodaro ドキュメント
ドキュメントノードリファレンスモデルAI エージェント(MCP)開発者向けセルフホスティングリサーチ
オーディオ

音声抽出

録音から背景ノイズ、音楽、その他の音を取り除き、声だけを残します。文字起こし、リップシンク、吹き替え、声の変換の前に、オーディオをクリーンにします。

音声抽出(Voice Extractor)ノードは、録音から背景ノイズ、音楽、その他の音を取り除き、声だけを返します。ElevenLabs の音声分離機能を使い、調整する設定はありません。ボイス系、リップシンク、文字起こしのノードの前に置いてください。これらのノードは、どれもクリーンな音声のほうがうまく動作します。

使いどころ

  • 編集する前に、インタビューやフィールド録音をクリーンにします。
  • 文字起こし(Transcribe)の前にノイズの多いオーディオをクリーンにして、文字起こしの精度を上げます。
  • 声を変換する前に、音楽やミックスされたオーディオからボーカルを取り出します。
  • ポッドキャストの録音から背景ノイズを取り除きます。
  • 吹き替え(Dubbing)の前に、動画のセリフを分離します。

クイックスタート

ノードを追加する

キャンバス上で Tab を押し、オーディオ › クリーンアップと分離 › 音声抽出を選びます。

録音を接続する

オーディオアップロード(Upload Audio)などのオーディオノードを、オーディオ入力に接続します。動画の音声を使うには、先に動画をオーディオを抽出(Extract Audio)に通します。

実行する

ノードの実行をクリックします。クリーンになった声が、プレーヤー付きでノードに表示されます。

オーディオオーディオオーディオアップロードノイズの多い街頭インタビュー音声抽出文字起こし
ノイズの多いインタビューを、文字起こしの前にクリーンにします。

入力と出力

入力接続できるノード説明
オーディオオーディオアップロード、リファレンスオーディオ(Reference Audio)、テキストから音声(Text to Speech)などのオーディオ系ノードクリーンにする録音です。

出力のオーディオは、声だけになったクリーンな録音です。これはデータではなくオーディオです。単語のタイミングが必要な場合は、文字起こしか強制アライメント(Forced Alignment)を使います。

設定

音声抽出には、キャンバスに表示される名前であるラベル以外に、設定はありません。

モデル

モデル開発元モードクレジット詳細
ElevenLabs Voice IsolationElevenLabs音声の分離74ボーカルトラックから、背景のノイズや音楽を取り除きます。

クリーンアップ用ノードの選び方

目的使うノード
ノイズと音楽を取り除いた、クリーンな声だけ音声抽出
任意の曲のボーカルとインストゥルメンタル(2 つのトラック)音源分離(Audio Separation)の「ボーカル/インストゥルメンタル」モード
ドラム、ベース、ピアノなどの個別のステム音源分離の「フルステム」モード
Suno で作った曲のボーカルとステムSuno 音源分離(Suno Separate)

ヒント

API から

POST /v1/audio-isolation は audioUrl を受け取ります。MCP ツールは audio_isolation です。音声とメディアを参照してください。

よくある質問

最終更新

目次