Nodaro ドキュメント
ドキュメントノードリファレンスモデルAI エージェント(MCP)開発者向けセルフホスティングリサーチ
ツールリファレンス

動画

AI アシスタント向けの Nodaro の動画ツールで、テキストや画像から動画を生成し、クリップの延長、スタイル変更、リライティング、アップスケールができます。顔をしゃべらせたり、動かしたりもできます。

動画ツールを使うと、アシスタントは Nodaro で動画を作成、変換できます。テキストや画像からクリップを生成し、延長やスタイル変更、リライティング、アップスケールを行い、顔をしゃべらせたり、動きをコピーしたりできます。各ツールはジョブを開始してその ID を返し、結果はライブラリに保存されます。どの動画ツールにも workflows:execute 権限が必要です。動画のジョブには、通常 2〜10 分かかります。

ツール機能
generate_videoテキストから動画を作る(リファレンスは任意)
animate_image画像から動画を作る(終了フレームは任意)
extend_videoクリップを時間的に先へ続ける
modify_videoプロンプトでクリップのスタイルを変える、または編集する
relight_videoクリップ自体のピクセルを使って、ライティングを変える、または背景を差し替える
video_upscaleクリップをアップスケールする
lip_syncオーディオトラックに合わせて、顔に話させる、または歌わせる
speech_to_video音声クリップに合わせてポートレートを動かす
motion_transfer動画の動きをキャラクター画像にコピーする
face_swap動画の中の顔を置き換える
stop_video_pro, continue_video_pro動画生成 Pro(Generate Video Pro)の長い実行を停止する、または再開する

generate_video

テキストプロンプトから動画を作成します。動画生成(Generate Video)ノードと同じように動作します。

権限:workflows:execute。クレジット:モデルの料金です。ほとんどのモデルは、長さと解像度で料金が決まります。料金を伝える前に、list_models でモデルの pricing を確認してください。

パラメーター型説明
promptstring動画の説明で、最大 8,000 文字です。プリセットが提供する場合を除き、必須です。
modelstringモデル ID です。デフォルトは seedance-2-fast です。不明な ID を指定すると、デフォルトのモデルが使われます。
durationnumber秒数です。対応している最も近い値が使われます。-1 にすると、Seedance 2 が長さを決めます。
aspect_ratiostringたとえば 16:9、9:16、1:1 です。デフォルトは 16:9 です。対応していない値を指定すると、代わりの値が使われます。
resolutionstringたとえば 480p、720p、1080p、4k で、モデルによって異なります。指定しない場合は、そのモデルで最も低い解像度が使われます。これが最も安い解像度です。
soundboolean対応しているモデルで、サウンドを生成します。
negative_promptstring避けたい内容で、最大 8,000 文字です。
seedinteger固定のシードです。対応しているモデルで使えます。
reference_image_urlsarray被写体の同一性やスタイルを伝えるリファレンス画像を、URL または Nodaro の ID で指定します。上限はモデルごとに異なります。たとえば、Seedance 2.5 では 30 枚、Seedance 2 と MiniMax Hailuo 3 では 9 枚、Gemini Omni では 7 枚、VEO 3.1 では 3 枚です。リファレンスに対応していないモデルは、これを無視します。
reference_video_urlsarrayスタイルや動きを伝えるリファレンス動画です。対応しているモデルで使えます。
reference_video_captionsarray各リファレンス動画の用途を、同じ順番で、それぞれ最大 500 文字で指定します。各キャプションは、プロンプト内で @video_1: … のような行になります。
reference_audio_urlsarray動きの元になるリファレンスオーディオです。対応しているモデルで使えます。
presetIdstringlist_node_presets で取得したプリセットです。指定したフィールドは、プリセットより優先されます。
structuredobjectプロンプトに追加する、構造化された詳細です。generate_image と同じです。
described_referencesarray名前は挙げられるものの画像がない被写体を指定する、最大 10 個の { name, description } エントリーです。
connected_references, reference_orderarray上級者向けです。エディター独自の形式で、ラベルと順序を付けたリファレンスです。最大 14 個です。

戻り値:ジョブ ID です。MCP Apps に対応したクライアントでは、動画の準備ができるとカードで再生されます。

Seedance では、複数の場面がある動画を Shot 1: … Shot 2: … の形で書き、カメラの動きはショットごとに 1 つにして、サウンドもプロンプトの中で説明してください。get_node_skill に generate-video を指定すると、モデルファミリーごとのプロンプトのルールが返されます。

リファレンス動画は、そのクリップの何かをコピーするようモデルに指示するものです。何のためのリファレンスなのかを、reference_video_captions で伝えてください。たとえば、3D シーンをグレーのクレイでレンダリングした動画は、レイアウトのガイドであって、見た目の指定ではありません。キャプションがないと、モデルがグレーのクレイの見た目までコピーすることがあります。

モデルごとの注意点

モデル注意点
Seedance 2(seedance-2)resolution: "4k" と、aspect_ratio: "adaptive" または "21:9" を受け付けます。
Seedance 2 Fast と Mini(seedance-2-fast、seedance-2-mini)480p と 720p のみです。
Seedance 2.5(seedance-2-5)480p、720p、1080p に対応し、1 回の呼び出しで最長 30 秒まで生成できます。リファレンスは、画像が最大 30 枚、動画が 10 本、オーディオクリップが 10 本までです。
MiniMax Hailuo 3(minimax-h3)リファレンスは、画像が最大 9 枚、動画が 3 本、オーディオクリップが 3 本までです。resolution は 2K(デフォルト)か、より安い 768P で、オーディオは常にオンです。テキストだけから作る動画では、具体的なアスペクト比が必要です。リファレンス動画はそれぞれ 2〜15 秒で、合計 15 秒までです。リファレンスオーディオは、画像または動画のリファレンスと一緒に指定する必要があります。
Wan 3.0(wan-3、wan-3-prime)リファレンスは、画像が最大 10 枚、動画が 5 本、オーディオクリップが 5 本までです。各クリップは 1〜15 秒で、種類ごとの合計は 15 秒までです。duration は 2〜30 秒で、デフォルトは 5 秒です。resolution は 480p、720p、1080p のいずれかです。wan-3-prime は、より速く、料金は高くなります。
Gemini Omni Flash(gemini-omni-flash)Gemini Omni の、より安くて速いバージョンです。duration は 4、6、8、10 秒のいずれかで、デフォルトは 8 秒です。aspect_ratio は 16:9 または 9:16 です。resolution は 720p、1080p、4k のいずれかです。
VEO 3.1 Quality(veo3)リファレンスモードがありません。リファレンスを使う場合は、VEO 3.1 Fast または Lite を使ってください。

Seedance 2、MiniMax Hailuo 3、Wan 3.0 では、リファレンスと一緒に渡した開始フレームや終了フレームは、リファレンス画像の 1 枚として扱われ、プロンプトでは最初または最後のフレームとして説明されます。Seedance では、リファレンス動画は入力の長さと出力の長さの合計で課金されます。そのため、リファレンスのクリップが長いほど、確保されるクレジットが多くなります。

animate_image

静止画を動画にします。終了フレームも渡すと、最初の画像から 2 枚目の画像へと動く動画になります。動画生成の「画像から動画」モードと同じように動作します。

権限:workflows:execute。クレジット:モデルの料金です。

パラメーター型説明
image_url or image_asset_idstring最初のフレームです。
end_frame_url or end_frame_asset_idstring最後のフレームです。list_models の features に end-frame を含むモデルを選んでください。
promptstring動画の中で起こることで、最大 8,000 文字です。
modelstringデフォルトは seedance-2-fast です。不明な ID を指定すると、デフォルトのモデルが使われます。
duration, aspect_ratio, resolution, soundgenerate_video と同じです。
reference_image_urls, reference_video_urls, reference_audio_urlsarrayリファレンスです。上限はモデルごとに異なります。たとえば画像は、Seedance 2.5 では 30 枚、Seedance 2 と MiniMax Hailuo 3 では 9 枚、Gemini Omni、Kling 3 Omni、Grok では 7 枚です。
loop_trimobject結果を、最もきれいにループする位置でトリミングします。enabled、frames_to_test(1〜64)、quality(lossless または precise)を指定します。古い auto_loop_trim パラメーターも引き続き使え、このパラメーターに対応付けられます。
described_references, connected_references, reference_orderarraygenerate_video と同じです。

ツールは、渡された内容からモードを選びます。フレーム(最初のフレームと、任意の最後のフレーム)か、リファレンスです。リファレンス動画とリファレンスオーディオは、終了フレームと組み合わせられません。シームレスなループにするには、最初と最後のフレームに同じ画像を使い、サウンドをオフにします。その後、combine_videos でコピーをつなぎ、merge_video_audio でサウンドを追加します。

戻り値:ジョブ ID です。

extend_video

クリップを時間的に先へ続けます。まずモデルを選んでください。2 つのモデルは自分が生成した動画の続きを作り、1 つのモデルはどの動画でも延長できます。

権限:workflows:execute。クレジット:延長に使うモデルの料金です。

モデル開発元モードクレジット詳細
Seedance 2 ExtendBytedance動画の延長260 からどんな動画でも延長でき、オーディオを含めて続きを生成し、トリミングしてつなぎ合わせて、継ぎ目のない 1 本のクリップにします。
VEO ExtendGoogle動画の延長190 から既存の VEO 3.1 のクリップを、さらに 1 セグメント分延長します。
Runway ExtendRunway動画の延長320Runway の動画を、さらに 1 クリップ分延長します。
パラメーター型説明
modelstring必須。seedance-2-extend、veo-extend、runway-extend のいずれかです。
promptstring必須。次に起こることで、最大 8,000 文字です。seedance-2-extend では、続きの部分だけを説明します。
video_url or video_asset_idstringseedance-2-extend 専用です。延長する動画で、どこで作った動画でも使えます。
kie_task_idstringveo-extend と runway-extend 専用です。以前の VEO または Runway の生成のタスク ID で、そのジョブの出力から取得します。
durationintegerseedance-2-extend で追加する秒数です。4〜15 で、デフォルトは 8 です。
generate_audiobooleanseedance-2-extend で、サウンドトラックの続きも作ります。デフォルトは true です。
resolutionstringseedance-2-extend の解像度で、480p、720p(デフォルト)、1080p、4k のいずれかです。つなぎ目を最もきれいにするには、元の動画に合わせてください。
reference_image_urlsarrayseedance-2-extend のリファレンス画像で、最大 8 枚です。プロンプトでは、リストの順に @image_1〜@image_8 と呼びます。
veo_qualitystringveo-extend の品質で、fast または quality です。
runway_resolutionstringrunway-extend の解像度で、720p または 1080p です。
seedinteger10,000〜99,999 です。

戻り値:ジョブ ID です。seedance-2-extend は、続きの場面をオーディオ付きで生成し、元の動画とつないで 1 本のクリップにします。

modify_video

プロンプトを使って、既存のクリップのスタイルを変えたり、編集したりします。動画から動画(Video to Video)ノードと同じように動作します。

権限:workflows:execute。クレジット:モデルの料金です。

パラメーター型説明
promptstring必須。変更内容で、最大 8,000 文字です。
video_url or video_asset_idstring必須(どちらか一方)。元のクリップです。
modelstringwan(デフォルト。Wan 2.6 で、汎用的な選択肢)、wan-flash、wan-videoedit、luma-modify、runway-aleph、happyhorse-edit、seedance-2-5 のいずれかです。不明な ID を指定すると、wan が使われます。
durationstringWan と Wan Flash で、5 または 10 秒です。
resolutionstringWan と Wan Flash では 720p または 1080p、Seedance 2.5 では 480p〜1080p です。
aspect_ratiostringRunway Aleph 専用です。16:9、9:16、4:3、3:4、1:1、21:9 のいずれかです。
audiobooleanWan Flash 専用です。オーディオを残すか、生成し直すかを指定します。
multi_shotsbooleanWan Flash 専用です。クリップ内でのシーンの切り替わりを許可します。
reference_image_urlstringRunway Aleph 専用です。スタイルのリファレンス画像です。
reference_image_urlsarraySeedance 2.5 専用です。最大 30 枚の画像で、プロンプトでは {image:1}、{image:2} のように参照します。
seedinteger固定のシードです。

seedance-2-5 では、プロンプトはクリップ全体を編集する指示になります。結果は、元のクリップの長さとアスペクト比を保ちます。クリップの長さは 4〜30 秒である必要があります。料金は、リファレンス動画を使う Seedance 2.5 の実行と同じように計算されます。入力の秒数と出力の秒数の合計で、最も長いクリップの分が確保され、実際に納品された長さで精算されます。

戻り値:ジョブ ID です。

relight_video

元の動画自体のピクセルを使って、クリップのライティングを変えたり、背景を差し替えたり、背景のスタイルを変えたり、新しい要素を合成したりします。Beeble SwitchX を使い、リライティングと差し替え(Relight & Switch)ノードと同じように動作します。

権限:workflows:execute。クレジット:フレーム数と出力解像度で決まります。

パラメーター型説明
video_url or video_asset_idstring元のクリップです。最大 240 フレーム、1 フレームあたり最大 2,770,000 ピクセルです。
promptstring新しいライティングや見た目で、最大 2,000 文字です。プロンプト、リファレンス画像、またはその両方を渡します。
reference_image_urlstring新しい見た目のリファレンス画像です。指定することを強くおすすめします。
alpha_modestringauto(デフォルト)は、メインの被写体をマスクします。fill は、フレーム全体のスタイルを変えます。select は、mask_url を 1 つのキーフレームのマスクとして使います。custom は、mask_url をすべてのフレームに使うマスク動画として使います。
mask_urlstringselect と custom では必須です。
alpha_keyframe_indexintegerselect の場合に、マスクが表すフレームです。0 から数えます。
max_resolutionstring720 または 1080(デフォルト)です。
seedinteger固定のシードです。

戻り値:ジョブ ID です。結果には、SwitchX で作成されたことを示す表記が付きます。

video_upscale

クリップを、より高い解像度にアップスケールします。動画をアップスケール(Upscale Video)ノードと同じように動作します。

権限:workflows:execute。クレジット:アップスケールに使うモデルの料金です。

モデル開発元モードクレジット詳細
Topaz Video UpscaleTopaz動画のアップスケール190高品質な動画のアップスケールと画質の向上を行います。
VEO 1080p UpscaleGoogle動画のアップスケール20VEO の出力を 1080p にアップスケールします。
VEO 4K UpscaleGoogle動画のアップスケール380VEO の出力を 4K にアップスケールします。
パラメーター型説明
modelstringtopaz(デフォルト)、veo-1080p、veo-4k のいずれかです。
video_url or video_asset_idstringtopaz では必須です。
upscale_factorstringtopaz の倍率で、1、2、4 のいずれかです。デフォルトは 2 です。
kie_task_idstringveo-1080p と veo-4k では必須です。元の VEO の生成のタスク ID です。

戻り値:ジョブ ID です。

lip_sync

オーディオトラックに合わせて、顔に話させたり歌わせたりします。ポートレートをトーキングヘッド動画にしたり、既存のクリップの口の動きを新しいオーディオに合わせたりできます。リップシンク(Lip Sync)ノードと同じように動作します。

権限:workflows:execute。クレジット:モデルの料金です。各モデルの料金は、ツールの model の説明に記載されています。

パラメーター型説明
image_url or image_asset_idstringポートレートです。kling-avatar、kling-avatar-pro、infinitalk で使います。
video_url or video_asset_idstring顔が映ったクリップです。latentsync や video-retalking など、既存の動画の顔を動かし直すモデルで使います。
audio_url or audio_asset_idstring話し声または歌です。
modelstringデフォルトは kling-avatar で、720p のトーキングヘッドです。ほかに kling-avatar-pro、infinitalk、omnihuman-1-5、latentsync、wav2lip、video-retalking、sadtalker、heygen-lipsync-precision、lipsync-2-pro、sync-lipsync-v3、volcengine-lipsync、Seedance 2 ファミリー、minimax-h3 などがあります。不明な ID を指定すると、kling-avatar が使われます。
promptstring演技のヒントで、最大 500 文字です。たとえば a confident TED speaker のように書きます。一部のモデルが使います。
resolutionstringInfiniTalk では 480p または 720p、Seedance 2 と 2 Fast では 480p、720p、1080p のいずれか、OmniHuman 1.5 では 720p または 1080p(デフォルト)です。
seed, fast_modeOmniHuman 1.5 専用です。固定のシードと、品質がわずかに下がる代わりに速いモードです。
modestringVolcengine 専用です。lite(デフォルト。カメラを向いた 1 人)または basic(複雑なシーン)です。
open_scenedet, separate_vocal, align_audio, align_audio_reverse, templ_start_secondsVolcengine 専用です。複数の話者がいる場合の話者検出、オーディオのノイズ除去、元の動画をオーディオの長さまでループする設定、元の動画での開始時間です。

get_node_skill に lip-sync を指定すると、歌、吹き替え、映画的な全身ショット、最も安い下書きのそれぞれに、どのモデルが合うかがわかります。

モデル開発元モードクレジット詳細
minimax-h3MiniMax画像から動画、テキストから動画230 からMiniMax Hailuo 3 はプレミアムなマルチモーダルのティアで、最初と最後のフレームに加えて画像/動画/オーディオのリファレンスを使え、ネイティブオーディオに対応し、2K(デフォルト)または 768P で出力し、長さは 4〜15 秒で料金は秒単位です。
Kling Avatar StandardKuaishouリップシンク280静止画のポートレートを、元になるオーディオに合わせてリップシンクします。品質は標準です。
Kling Avatar ProKuaishouリップシンク560プレミアムなリップシンクで、口の形とタイミングがより正確です。
Seedance 2Bytedance画像から動画、テキストから動画230 からSeedance 2 は、ネイティブオーディオ付きのプレミアムなティアです。料金は解像度ごとの秒単位です。
Seedance 2 FastBytedance画像から動画、テキストから動画180 からSeedance 2 の、より安価で高速なティアです。
Seedance 2 MiniBytedance画像から動画、テキストから動画120 からSeedance 2 の低価格なティアで、480p/720p のみに対応し、料金は解像度ごとの秒単位です。
Seedance 2.5Bytedance画像から動画、テキストから動画340 からSeedance 2.5 は、1 ショットで最大 30 秒を生成でき、ネイティブオーディオと幅広いマルチモーダルのリファレンスに対応しています。解像度は 480p/720p/1080p です。
OmniHuman 1.5Bytedanceリップシンク1020 から静止画とオーディオから、プロンプトで演出できるプレミアムな話すアバターを作ります。720p または 1080p で、長さは最大 60 秒です。人物、ペット、アニメに対応しています。
InfiniTalkInfiniTalkリップシンク110 から静止画から、オーディオに合わせて話すトーキングヘッドを作ります。解像度は 480p または 720p です。
Sync Lipsync v3Syncリップシンク1000 から既存の映像を吹き替え、唇の動きを新しいオーディオトラックに合わせ直します。動画を入力し、1 秒ごとに課金されます。
Volcengine Lip SyncVolcengineリップシンク300 から動画から動画への AI 吹き替えで、唇の動きを新しいボーカルトラックに合わせ直します。ベーシックモードでは複数話者に対応します(シーン検出と話者の識別)。動画を入力し、1 秒ごとに課金されます。

戻り値:ジョブ ID です。動画の準備ができると、カードで再生されます。

speech_to_video

ポートレートを動かし、音声クリップの内容を話させます。顔はリップシンクされ、頭と体も動きます。Wan Speech to Video を使い、音声から動画(Speech to Video)ノードと同じように動作します。

権限:workflows:execute。クレジット:30〜60。

パラメーター型説明
promptstring必須。動きとシーンで、最大 2,500 文字です。
image_url or image_asset_idstringポートレートです。
audio_url or audio_asset_idstring話し声です。
resolutionstring480p(デフォルト)、580p、720p のいずれかです。
negative_promptstring避けたい内容で、最大 2,500 文字です。

戻り値:ジョブ ID です。

motion_transfer

動きの元になる動画のモーションをキャラクター画像にコピーし、キャラクターに同じ動きをさせます。モーション転送(Motion Transfer)ノードと同じように動作します。

権限:workflows:execute。クレジット:モデルと長さに応じた料金です。

パラメーター型説明
image_url or image_asset_idstring必須。キャラクターです。
video_url or video_asset_idstring必須。動きをコピーする元の動画です。
promptstring求める結果で、最大 8,000 文字です。
providerstringモデルです。デフォルトは kling です。
resolutionstring480p、580p、720p(デフォルト)、1080p のいずれかです。
character_orientationstringどちらのフレーミングを優先するかです。image(デフォルト)または video です。
background_sourcestringどちらの入力から背景を取るかです。input_video または input_image で、対応しているモデルで使えます。
video_durationnumber出力の長さで、1〜60 秒です。対応しているモデルで使えます。

戻り値:ジョブ ID です。

face_swap

動画の中の顔を、ポートレートの顔に置き換えます。フェイススワップ(Face Swap)ノードと同じように動作します。

権限:workflows:execute。クレジット:130。

パラメーター型説明
video_url or video_asset_idstring元の動画です。
face_image_url or face_image_asset_idstring使う顔が写ったポートレートです。

戻り値:ジョブ ID です。

stop_video_pro

実行中の動画生成 Pro のジョブを停止します。動画生成 Pro は、長い動画をセグメントに分けて作るエンジンで、たとえば 動画生成 Pro ノードを含むワークフローから使われます。処理中のセグメントは破棄されますが、その料金は請求されます。残りのセグメントはスキップされ、完成したセグメントはすべてつなぎ合わされて、ジョブの最終的な動画になります。確保されたクレジットの残りは返還されます。まだ開始していないジョブはキャンセルされ、全額が返還されます。

権限:workflows:execute。クレジット:無料。確保されたクレジットのうち、使われなかった分は返還されます。

パラメーター型説明
job_idstring必須。動画生成 Pro のジョブです。

戻り値:処理の確認です。get_job でジョブをポーリングしてください。ジョブは、output_data.pro.stopped が true になった状態で完了し、途中までの動画が結果になります。

continue_video_pro

停止、失敗、または完了した動画生成 Pro の実行を、新しいジョブとして続けます。from_segment より前のセグメントは再利用され、from_segment 以降のすべてのセグメントが生成し直されます。失敗した実行を続けるには、納品済みのセグメントが 1 つ以上必要です。

権限:workflows:execute。クレジット:生成し直すセグメントの分と、動画生成 Pro の固定料金だけです。

パラメーター型説明
job_idstring必須。元の動画生成 Pro のジョブです。
from_segmentinteger生成し直す最初のセグメントです。1 から数え、最大 24 です。デフォルトは、最初の欠けているセグメントです。完了した実行の終わりの部分を作り直すには、それより前のセグメントを指定します。

戻り値:新しいジョブ ID です。

よくある質問

最終更新

目次