動画
AI アシスタント向けの Nodaro の動画ツールで、テキストや画像から動画を生成し、クリップの延長、スタイル変更、リライティング、アップスケールができます。顔をしゃべらせたり、動かしたりもできます。
動画ツールを使うと、アシスタントは Nodaro で動画を作成、変換できます。テキストや画像からクリップを生成し、延長やスタイル変更、リライティング、アップスケールを行い、顔をしゃべらせたり、動きをコピーしたりできます。各ツールはジョブを開始してその ID を返し、結果はライブラリに保存されます。どの動画ツールにも workflows:execute 権限が必要です。動画のジョブには、通常 2〜10 分かかります。
| ツール | 機能 |
|---|---|
generate_video | テキストから動画を作る(リファレンスは任意) |
animate_image | 画像から動画を作る(終了フレームは任意) |
extend_video | クリップを時間的に先へ続ける |
modify_video | プロンプトでクリップのスタイルを変える、または編集する |
relight_video | クリップ自体のピクセルを使って、ライティングを変える、または背景を差し替える |
video_upscale | クリップをアップスケールする |
lip_sync | オーディオトラックに合わせて、顔に話させる、または歌わせる |
speech_to_video | 音声クリップに合わせてポートレートを動かす |
motion_transfer | 動画の動きをキャラクター画像にコピーする |
face_swap | 動画の中の顔を置き換える |
stop_video_pro, continue_video_pro | 動画生成 Pro(Generate Video Pro)の長い実行を停止する、または再開する |
generate_video
テキストプロンプトから動画を作成します。動画生成(Generate Video)ノードと同じように動作します。
権限:workflows:execute。クレジット:モデルの料金です。ほとんどのモデルは、長さと解像度で料金が決まります。料金を伝える前に、list_models でモデルの pricing を確認してください。
| パラメーター | 型 | 説明 |
|---|---|---|
prompt | string | 動画の説明で、最大 8,000 文字です。プリセットが提供する場合を除き、必須です。 |
model | string | モデル ID です。デフォルトは seedance-2-fast です。不明な ID を指定すると、デフォルトのモデルが使われます。 |
duration | number | 秒数です。対応している最も近い値が使われます。-1 にすると、Seedance 2 が長さを決めます。 |
aspect_ratio | string | たとえば 16:9、9:16、1:1 です。デフォルトは 16:9 です。対応していない値を指定すると、代わりの値が使われます。 |
resolution | string | たとえば 480p、720p、1080p、4k で、モデルによって異なります。指定しない場合は、そのモデルで最も低い解像度が使われます。これが最も安い解像度です。 |
sound | boolean | 対応しているモデルで、サウンドを生成します。 |
negative_prompt | string | 避けたい内容で、最大 8,000 文字です。 |
seed | integer | 固定のシードです。対応しているモデルで使えます。 |
reference_image_urls | array | 被写体の同一性やスタイルを伝えるリファレンス画像を、URL または Nodaro の ID で指定します。上限はモデルごとに異なります。たとえば、Seedance 2.5 では 30 枚、Seedance 2 と MiniMax Hailuo 3 では 9 枚、Gemini Omni では 7 枚、VEO 3.1 では 3 枚です。リファレンスに対応していないモデルは、これを無視します。 |
reference_video_urls | array | スタイルや動きを伝えるリファレンス動画です。対応しているモデルで使えます。 |
reference_video_captions | array | 各リファレンス動画の用途を、同じ順番で、それぞれ最大 500 文字で指定します。各キャプションは、プロンプト内で @video_1: … のような行になります。 |
reference_audio_urls | array | 動きの元になるリファレンスオーディオです。対応しているモデルで使えます。 |
presetId | string | list_node_presets で取得したプリセットです。指定したフィールドは、プリセットより優先されます。 |
structured | object | プロンプトに追加する、構造化された詳細です。generate_image と同じです。 |
described_references | array | 名前は挙げられるものの画像がない被写体を指定する、最大 10 個の { name, description } エントリーです。 |
connected_references, reference_order | array | 上級者向けです。エディター独自の形式で、ラベルと順序を付けたリファレンスです。最大 14 個です。 |
戻り値:ジョブ ID です。MCP Apps に対応したクライアントでは、動画の準備ができるとカードで再生されます。
Seedance では、複数の場面がある動画を Shot 1: … Shot 2: … の形で書き、カメラの動きはショットごとに 1 つにして、サウンドもプロンプトの中で説明してください。get_node_skill に generate-video を指定すると、モデルファミリーごとのプロンプトのルールが返されます。
リファレンス動画は、そのクリップの何かをコピーするようモデルに指示するものです。何のためのリファレンスなのかを、reference_video_captions で伝えてください。たとえば、3D シーンをグレーのクレイでレンダリングした動画は、レイアウトのガイドであって、見た目の指定ではありません。キャプションがないと、モデルがグレーのクレイの見た目までコピーすることがあります。
モデルごとの注意点
| モデル | 注意点 |
|---|---|
Seedance 2(seedance-2) | resolution: "4k" と、aspect_ratio: "adaptive" または "21:9" を受け付けます。 |
Seedance 2 Fast と Mini(seedance-2-fast、seedance-2-mini) | 480p と 720p のみです。 |
Seedance 2.5(seedance-2-5) | 480p、720p、1080p に対応し、1 回の呼び出しで最長 30 秒まで生成できます。リファレンスは、画像が最大 30 枚、動画が 10 本、オーディオクリップが 10 本までです。 |
MiniMax Hailuo 3(minimax-h3) | リファレンスは、画像が最大 9 枚、動画が 3 本、オーディオクリップが 3 本までです。resolution は 2K(デフォルト)か、より安い 768P で、オーディオは常にオンです。テキストだけから作る動画では、具体的なアスペクト比が必要です。リファレンス動画はそれぞれ 2〜15 秒で、合計 15 秒までです。リファレンスオーディオは、画像または動画のリファレンスと一緒に指定する必要があります。 |
Wan 3.0(wan-3、wan-3-prime) | リファレンスは、画像が最大 10 枚、動画が 5 本、オーディオクリップが 5 本までです。各クリップは 1〜15 秒で、種類ごとの合計は 15 秒までです。duration は 2〜30 秒で、デフォルトは 5 秒です。resolution は 480p、720p、1080p のいずれかです。wan-3-prime は、より速く、料金は高くなります。 |
Gemini Omni Flash(gemini-omni-flash) | Gemini Omni の、より安くて速いバージョンです。duration は 4、6、8、10 秒のいずれかで、デフォルトは 8 秒です。aspect_ratio は 16:9 または 9:16 です。resolution は 720p、1080p、4k のいずれかです。 |
VEO 3.1 Quality(veo3) | リファレンスモードがありません。リファレンスを使う場合は、VEO 3.1 Fast または Lite を使ってください。 |
Seedance 2、MiniMax Hailuo 3、Wan 3.0 では、リファレンスと一緒に渡した開始フレームや終了フレームは、リファレンス画像の 1 枚として扱われ、プロンプトでは最初または最後のフレームとして説明されます。Seedance では、リファレンス動画は入力の長さと出力の長さの合計で課金されます。そのため、リファレンスのクリップが長いほど、確保されるクレジットが多くなります。
animate_image
静止画を動画にします。終了フレームも渡すと、最初の画像から 2 枚目の画像へと動く動画になります。動画生成の「画像から動画」モードと同じように動作します。
権限:workflows:execute。クレジット:モデルの料金です。
| パラメーター | 型 | 説明 |
|---|---|---|
image_url or image_asset_id | string | 最初のフレームです。 |
end_frame_url or end_frame_asset_id | string | 最後のフレームです。list_models の features に end-frame を含むモデルを選んでください。 |
prompt | string | 動画の中で起こることで、最大 8,000 文字です。 |
model | string | デフォルトは seedance-2-fast です。不明な ID を指定すると、デフォルトのモデルが使われます。 |
duration, aspect_ratio, resolution, sound | generate_video と同じです。 | |
reference_image_urls, reference_video_urls, reference_audio_urls | array | リファレンスです。上限はモデルごとに異なります。たとえば画像は、Seedance 2.5 では 30 枚、Seedance 2 と MiniMax Hailuo 3 では 9 枚、Gemini Omni、Kling 3 Omni、Grok では 7 枚です。 |
loop_trim | object | 結果を、最もきれいにループする位置でトリミングします。enabled、frames_to_test(1〜64)、quality(lossless または precise)を指定します。古い auto_loop_trim パラメーターも引き続き使え、このパラメーターに対応付けられます。 |
described_references, connected_references, reference_order | array | generate_video と同じです。 |
ツールは、渡された内容からモードを選びます。フレーム(最初のフレームと、任意の最後のフレーム)か、リファレンスです。リファレンス動画とリファレンスオーディオは、終了フレームと組み合わせられません。シームレスなループにするには、最初と最後のフレームに同じ画像を使い、サウンドをオフにします。その後、combine_videos でコピーをつなぎ、merge_video_audio でサウンドを追加します。
戻り値:ジョブ ID です。
extend_video
クリップを時間的に先へ続けます。まずモデルを選んでください。2 つのモデルは自分が生成した動画の続きを作り、1 つのモデルはどの動画でも延長できます。
権限:workflows:execute。クレジット:延長に使うモデルの料金です。
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|---|---|---|---|
| Seedance 2 Extend | Bytedance | 動画の延長 | 260 から | どんな動画でも延長でき、オーディオを含めて続きを生成し、トリミングしてつなぎ合わせて、継ぎ目のない 1 本のクリップにします。 |
| VEO Extend | 動画の延長 | 190 から | 既存の VEO 3.1 のクリップを、さらに 1 セグメント分延長します。 | |
| Runway Extend | Runway | 動画の延長 | 320 | Runway の動画を、さらに 1 クリップ分延長します。 |
| パラメーター | 型 | 説明 |
|---|---|---|
model | string | 必須。seedance-2-extend、veo-extend、runway-extend のいずれかです。 |
prompt | string | 必須。次に起こることで、最大 8,000 文字です。seedance-2-extend では、続きの部分だけを説明します。 |
video_url or video_asset_id | string | seedance-2-extend 専用です。延長する動画で、どこで作った動画でも使えます。 |
kie_task_id | string | veo-extend と runway-extend 専用です。以前の VEO または Runway の生成のタスク ID で、そのジョブの出力から取得します。 |
duration | integer | seedance-2-extend で追加する秒数です。4〜15 で、デフォルトは 8 です。 |
generate_audio | boolean | seedance-2-extend で、サウンドトラックの続きも作ります。デフォルトは true です。 |
resolution | string | seedance-2-extend の解像度で、480p、720p(デフォルト)、1080p、4k のいずれかです。つなぎ目を最もきれいにするには、元の動画に合わせてください。 |
reference_image_urls | array | seedance-2-extend のリファレンス画像で、最大 8 枚です。プロンプトでは、リストの順に @image_1〜@image_8 と呼びます。 |
veo_quality | string | veo-extend の品質で、fast または quality です。 |
runway_resolution | string | runway-extend の解像度で、720p または 1080p です。 |
seed | integer | 10,000〜99,999 です。 |
戻り値:ジョブ ID です。seedance-2-extend は、続きの場面をオーディオ付きで生成し、元の動画とつないで 1 本のクリップにします。
modify_video
プロンプトを使って、既存のクリップのスタイルを変えたり、編集したりします。動画から動画(Video to Video)ノードと同じように動作します。
権限:workflows:execute。クレジット:モデルの料金です。
| パラメーター | 型 | 説明 |
|---|---|---|
prompt | string | 必須。変更内容で、最大 8,000 文字です。 |
video_url or video_asset_id | string | 必須(どちらか一方)。元のクリップです。 |
model | string | wan(デフォルト。Wan 2.6 で、汎用的な選択肢)、wan-flash、wan-videoedit、luma-modify、runway-aleph、happyhorse-edit、seedance-2-5 のいずれかです。不明な ID を指定すると、wan が使われます。 |
duration | string | Wan と Wan Flash で、5 または 10 秒です。 |
resolution | string | Wan と Wan Flash では 720p または 1080p、Seedance 2.5 では 480p〜1080p です。 |
aspect_ratio | string | Runway Aleph 専用です。16:9、9:16、4:3、3:4、1:1、21:9 のいずれかです。 |
audio | boolean | Wan Flash 専用です。オーディオを残すか、生成し直すかを指定します。 |
multi_shots | boolean | Wan Flash 専用です。クリップ内でのシーンの切り替わりを許可します。 |
reference_image_url | string | Runway Aleph 専用です。スタイルのリファレンス画像です。 |
reference_image_urls | array | Seedance 2.5 専用です。最大 30 枚の画像で、プロンプトでは {image:1}、{image:2} のように参照します。 |
seed | integer | 固定のシードです。 |
seedance-2-5 では、プロンプトはクリップ全体を編集する指示になります。結果は、元のクリップの長さとアスペクト比を保ちます。クリップの長さは 4〜30 秒である必要があります。料金は、リファレンス動画を使う Seedance 2.5 の実行と同じように計算されます。入力の秒数と出力の秒数の合計で、最も長いクリップの分が確保され、実際に納品された長さで精算されます。
戻り値:ジョブ ID です。
relight_video
元の動画自体のピクセルを使って、クリップのライティングを変えたり、背景を差し替えたり、背景のスタイルを変えたり、新しい要素を合成したりします。Beeble SwitchX を使い、リライティングと差し替え(Relight & Switch)ノードと同じように動作します。
権限:workflows:execute。クレジット:フレーム数と出力解像度で決まります。
| パラメーター | 型 | 説明 |
|---|---|---|
video_url or video_asset_id | string | 元のクリップです。最大 240 フレーム、1 フレームあたり最大 2,770,000 ピクセルです。 |
prompt | string | 新しいライティングや見た目で、最大 2,000 文字です。プロンプト、リファレンス画像、またはその両方を渡します。 |
reference_image_url | string | 新しい見た目のリファレンス画像です。指定することを強くおすすめします。 |
alpha_mode | string | auto(デフォルト)は、メインの被写体をマスクします。fill は、フレーム全体のスタイルを変えます。select は、mask_url を 1 つのキーフレームのマスクとして使います。custom は、mask_url をすべてのフレームに使うマスク動画として使います。 |
mask_url | string | select と custom では必須です。 |
alpha_keyframe_index | integer | select の場合に、マスクが表すフレームです。0 から数えます。 |
max_resolution | string | 720 または 1080(デフォルト)です。 |
seed | integer | 固定のシードです。 |
戻り値:ジョブ ID です。結果には、SwitchX で作成されたことを示す表記が付きます。
video_upscale
クリップを、より高い解像度にアップスケールします。動画をアップスケール(Upscale Video)ノードと同じように動作します。
権限:workflows:execute。クレジット:アップスケールに使うモデルの料金です。
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|---|---|---|---|
| Topaz Video Upscale | Topaz | 動画のアップスケール | 190 | 高品質な動画のアップスケールと画質の向上を行います。 |
| VEO 1080p Upscale | 動画のアップスケール | 20 | VEO の出力を 1080p にアップスケールします。 | |
| VEO 4K Upscale | 動画のアップスケール | 380 | VEO の出力を 4K にアップスケールします。 |
| パラメーター | 型 | 説明 |
|---|---|---|
model | string | topaz(デフォルト)、veo-1080p、veo-4k のいずれかです。 |
video_url or video_asset_id | string | topaz では必須です。 |
upscale_factor | string | topaz の倍率で、1、2、4 のいずれかです。デフォルトは 2 です。 |
kie_task_id | string | veo-1080p と veo-4k では必須です。元の VEO の生成のタスク ID です。 |
戻り値:ジョブ ID です。
lip_sync
オーディオトラックに合わせて、顔に話させたり歌わせたりします。ポートレートをトーキングヘッド動画にしたり、既存のクリップの口の動きを新しいオーディオに合わせたりできます。リップシンク(Lip Sync)ノードと同じように動作します。
権限:workflows:execute。クレジット:モデルの料金です。各モデルの料金は、ツールの model の説明に記載されています。
| パラメーター | 型 | 説明 |
|---|---|---|
image_url or image_asset_id | string | ポートレートです。kling-avatar、kling-avatar-pro、infinitalk で使います。 |
video_url or video_asset_id | string | 顔が映ったクリップです。latentsync や video-retalking など、既存の動画の顔を動かし直すモデルで使います。 |
audio_url or audio_asset_id | string | 話し声または歌です。 |
model | string | デフォルトは kling-avatar で、720p のトーキングヘッドです。ほかに kling-avatar-pro、infinitalk、omnihuman-1-5、latentsync、wav2lip、video-retalking、sadtalker、heygen-lipsync-precision、lipsync-2-pro、sync-lipsync-v3、volcengine-lipsync、Seedance 2 ファミリー、minimax-h3 などがあります。不明な ID を指定すると、kling-avatar が使われます。 |
prompt | string | 演技のヒントで、最大 500 文字です。たとえば a confident TED speaker のように書きます。一部のモデルが使います。 |
resolution | string | InfiniTalk では 480p または 720p、Seedance 2 と 2 Fast では 480p、720p、1080p のいずれか、OmniHuman 1.5 では 720p または 1080p(デフォルト)です。 |
seed, fast_mode | OmniHuman 1.5 専用です。固定のシードと、品質がわずかに下がる代わりに速いモードです。 | |
mode | string | Volcengine 専用です。lite(デフォルト。カメラを向いた 1 人)または basic(複雑なシーン)です。 |
open_scenedet, separate_vocal, align_audio, align_audio_reverse, templ_start_seconds | Volcengine 専用です。複数の話者がいる場合の話者検出、オーディオのノイズ除去、元の動画をオーディオの長さまでループする設定、元の動画での開始時間です。 |
get_node_skill に lip-sync を指定すると、歌、吹き替え、映画的な全身ショット、最も安い下書きのそれぞれに、どのモデルが合うかがわかります。
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|---|---|---|---|
| minimax-h3 | MiniMax | 画像から動画、テキストから動画 | 230 から | MiniMax Hailuo 3 はプレミアムなマルチモーダルのティアで、最初と最後のフレームに加えて画像/動画/オーディオのリファレンスを使え、ネイティブオーディオに対応し、2K(デフォルト)または 768P で出力し、長さは 4〜15 秒で料金は秒単位です。 |
| Kling Avatar Standard | Kuaishou | リップシンク | 280 | 静止画のポートレートを、元になるオーディオに合わせてリップシンクします。品質は標準です。 |
| Kling Avatar Pro | Kuaishou | リップシンク | 560 | プレミアムなリップシンクで、口の形とタイミングがより正確です。 |
| Seedance 2 | Bytedance | 画像から動画、テキストから動画 | 230 から | Seedance 2 は、ネイティブオーディオ付きのプレミアムなティアです。料金は解像度ごとの秒単位です。 |
| Seedance 2 Fast | Bytedance | 画像から動画、テキストから動画 | 180 から | Seedance 2 の、より安価で高速なティアです。 |
| Seedance 2 Mini | Bytedance | 画像から動画、テキストから動画 | 120 から | Seedance 2 の低価格なティアで、480p/720p のみに対応し、料金は解像度ごとの秒単位です。 |
| Seedance 2.5 | Bytedance | 画像から動画、テキストから動画 | 340 から | Seedance 2.5 は、1 ショットで最大 30 秒を生成でき、ネイティブオーディオと幅広いマルチモーダルのリファレンスに対応しています。解像度は 480p/720p/1080p です。 |
| OmniHuman 1.5 | Bytedance | リップシンク | 1020 から | 静止画とオーディオから、プロンプトで演出できるプレミアムな話すアバターを作ります。720p または 1080p で、長さは最大 60 秒です。人物、ペット、アニメに対応しています。 |
| InfiniTalk | InfiniTalk | リップシンク | 110 から | 静止画から、オーディオに合わせて話すトーキングヘッドを作ります。解像度は 480p または 720p です。 |
| Sync Lipsync v3 | Sync | リップシンク | 1000 から | 既存の映像を吹き替え、唇の動きを新しいオーディオトラックに合わせ直します。動画を入力し、1 秒ごとに課金されます。 |
| Volcengine Lip Sync | Volcengine | リップシンク | 300 から | 動画から動画への AI 吹き替えで、唇の動きを新しいボーカルトラックに合わせ直します。ベーシックモードでは複数話者に対応します(シーン検出と話者の識別)。動画を入力し、1 秒ごとに課金されます。 |
戻り値:ジョブ ID です。動画の準備ができると、カードで再生されます。
speech_to_video
ポートレートを動かし、音声クリップの内容を話させます。顔はリップシンクされ、頭と体も動きます。Wan Speech to Video を使い、音声から動画(Speech to Video)ノードと同じように動作します。
権限:workflows:execute。クレジット:30〜60。
| パラメーター | 型 | 説明 |
|---|---|---|
prompt | string | 必須。動きとシーンで、最大 2,500 文字です。 |
image_url or image_asset_id | string | ポートレートです。 |
audio_url or audio_asset_id | string | 話し声です。 |
resolution | string | 480p(デフォルト)、580p、720p のいずれかです。 |
negative_prompt | string | 避けたい内容で、最大 2,500 文字です。 |
戻り値:ジョブ ID です。
motion_transfer
動きの元になる動画のモーションをキャラクター画像にコピーし、キャラクターに同じ動きをさせます。モーション転送(Motion Transfer)ノードと同じように動作します。
権限:workflows:execute。クレジット:モデルと長さに応じた料金です。
| パラメーター | 型 | 説明 |
|---|---|---|
image_url or image_asset_id | string | 必須。キャラクターです。 |
video_url or video_asset_id | string | 必須。動きをコピーする元の動画です。 |
prompt | string | 求める結果で、最大 8,000 文字です。 |
provider | string | モデルです。デフォルトは kling です。 |
resolution | string | 480p、580p、720p(デフォルト)、1080p のいずれかです。 |
character_orientation | string | どちらのフレーミングを優先するかです。image(デフォルト)または video です。 |
background_source | string | どちらの入力から背景を取るかです。input_video または input_image で、対応しているモデルで使えます。 |
video_duration | number | 出力の長さで、1〜60 秒です。対応しているモデルで使えます。 |
戻り値:ジョブ ID です。
face_swap
動画の中の顔を、ポートレートの顔に置き換えます。フェイススワップ(Face Swap)ノードと同じように動作します。
権限:workflows:execute。クレジット:130。
| パラメーター | 型 | 説明 |
|---|---|---|
video_url or video_asset_id | string | 元の動画です。 |
face_image_url or face_image_asset_id | string | 使う顔が写ったポートレートです。 |
戻り値:ジョブ ID です。
stop_video_pro
実行中の動画生成 Pro のジョブを停止します。動画生成 Pro は、長い動画をセグメントに分けて作るエンジンで、たとえば 動画生成 Pro ノードを含むワークフローから使われます。処理中のセグメントは破棄されますが、その料金は請求されます。残りのセグメントはスキップされ、完成したセグメントはすべてつなぎ合わされて、ジョブの最終的な動画になります。確保されたクレジットの残りは返還されます。まだ開始していないジョブはキャンセルされ、全額が返還されます。
権限:workflows:execute。クレジット:無料。確保されたクレジットのうち、使われなかった分は返還されます。
| パラメーター | 型 | 説明 |
|---|---|---|
job_id | string | 必須。動画生成 Pro のジョブです。 |
戻り値:処理の確認です。get_job でジョブをポーリングしてください。ジョブは、output_data.pro.stopped が true になった状態で完了し、途中までの動画が結果になります。
continue_video_pro
停止、失敗、または完了した動画生成 Pro の実行を、新しいジョブとして続けます。from_segment より前のセグメントは再利用され、from_segment 以降のすべてのセグメントが生成し直されます。失敗した実行を続けるには、納品済みのセグメントが 1 つ以上必要です。
権限:workflows:execute。クレジット:生成し直すセグメントの分と、動画生成 Pro の固定料金だけです。
| パラメーター | 型 | 説明 |
|---|---|---|
job_id | string | 必須。元の動画生成 Pro のジョブです。 |
from_segment | integer | 生成し直す最初のセグメントです。1 から数え、最大 24 です。デフォルトは、最初の欠けているセグメントです。完了した実行の終わりの部分を作り直すには、それより前のセグメントを指定します。 |
戻り値:新しいジョブ ID です。
よくある質問
関連ページ
動画生成
リップシンク
動画編集
画像
動画モデル
最終更新