# 動画生成

> Seedance、VEO、Kling、Wan などのモデルで、プロンプト、開始フレーム、リファレンスから動画クリップを作ります。サウンド、終了フレーム、モデルごとのクレジットのルールも解説します。

Source: https://nodaro.ai/ja/docs/nodes/video/generate-video

**動画生成**（Generate Video）ノードは、プロンプト、画像、または複数のリファレンスから動画クリップを作ります。Nodaro のメインの動画ノードです。テキストから動画、画像から動画、開始フレームと終了フレームを指定したクリップ、リファレンスをもとにしたクリップを、すべてこのノードで作れます。モードは、接続したものからノードが選びます。動画モデルは、用意されたものから 1 つを選びます。結果は、[**動画を結合**（Combine Videos）](https://nodaro.ai/docs/nodes/video/combine-videos)など、ほかのどの動画ノードにも渡せます。

- Found in: Video › Create
- Output: video
- Credits: 30–8550 per run, by model
- Models: 37
- API type: `generate-video`

## 使いどころ
- 説明文から短いクリップを作りたいとき。B ロール、エスタブリッシングショット、商品の回転ショット、SNS 投稿などです。
- 静止画を動かしたいとき。[**画像生成**（Generate Image）](https://nodaro.ai/docs/nodes/image/generate-image)の結果などを、**開始フレーム**に接続します。
- ある画像で始まり、別の画像で終わるクリップを作りたいとき。**開始フレーム**と**終了フレーム**の両方に画像を接続します。
- 同じキャラクター、商品、場所を、たくさんのクリップに登場させたいとき。アセットノードかリファレンス画像を接続します。
- 既存のクリップを、指示で変更したいとき。Seedance 2.5 と Gemini Omni は、接続した動画を編集できます。

モデルの 1 回の実行で作れる長さを超えるクリップには、[**動画生成 Pro**（Generate Video Pro）](https://nodaro.ai/docs/nodes/video/generate-video-pro)を使います。手元にあるクリップの続きを作るには、[**動画を延長**（Extend Video）](https://nodaro.ai/docs/nodes/video/extend-video)を使います。

## クイックスタート
### ノードを追加する
キャンバス上で Tab を押すか、サイドバーからノードピッカーを開き、**動画 › 作成 › 動画生成**を選びます。

### プロンプトを書く
ノードにプロンプトを入力するか、[**テキスト**（Text）](https://nodaro.ai/docs/nodes/automate/text)ノードを**プロンプト**入力に接続します。何がどのように動き、カメラがどう動くかを書きます。

### 開始フレームがあれば接続する
画像ノードを**開始フレーム**に接続すると、その画像が動き出します。空のままにすると、プロンプトだけからクリップを作ります。

### モデルとクリップの設定を選ぶ
設定パネルを開きます。**プロバイダー**でモデルを選び、次に**長さ（秒）**、**解像度**、**アスペクト比**を選びます。選べる値はモデルによって変わります。ノードにポインターを合わせたときにノードの下に表示されるバーにも、同じ項目が表示されます。

### 実行する
**実行**をクリックします。クリップがノードに表示されます。それまでの結果も、すべてノードの結果一覧に残ります。

Workflow: プロンプト、冒頭のフレーム、キャラクター、カメラモーションのピッカーが動画生成に入力され、そのクリップが動画を結合に渡されます。

- テキスト → 動画生成 (プロンプト)
- 画像生成 → 動画生成 (開始フレーム)
- キャラクターアセット → 動画生成 (アセット)
- カメラモーション → 動画生成 (ルック)
- 動画生成 → 動画を結合

## ノードがモードを選ぶ仕組み
モードの切り替えスイッチはありません。ノードは実行時に、何が接続されているかを見てモードを選びます。

| 接続されているもの | ノードが作るもの |
| --- | --- |
| プロンプトのみ | テキストから動画のクリップです。 |
| **開始フレーム** | 画像から動画のクリップです。接続した画像から始まります。 |
| **開始フレーム**と**終了フレーム** | 最初の画像から最後の画像へと移り変わるクリップです。終了フレームに対応するモデルで使えます。 |
| **画像リファレンス**、**動画リファレンス**、または**オーディオリファレンス** | リファレンスをもとにしたクリップです。リファレンスに対応するモデルでは、モデルがリファレンスを使って結果を形づくります。 |
| Seedance 2.5 または Gemini Omni で、**動画リファレンス**にクリップを接続 | そのクリップを編集したものです。Gemini Omni では常に編集になり、Seedance 2.5 ではプロンプトが変更を求めているときに編集になります。[クリップを編集する](#edit-a-clip)を参照してください。 |

一覧のどのモデルも、どのモードでも選べます。ただし、一部のモデルでは次の点が異なります。

- **開始画像が必要なモデルがある**：テキストから動画のモードがないモデルがあります。該当するのは、Kling 2.1 Master、Kling 3 Omni、Hailuo 2.3、Hailuo 2.3 Pro、Bytedance Pro Fast、HappyHorse 1.1 Ref2V、Grok Imagine Video 1.5 です。これらのモデルでは、**開始フレーム**か**終了フレーム**に画像が接続されるまで**実行**は無効のままで、ボタンのツールチップにそのモデル名が表示されます。リファレンス画像だけでは、開始フレームとはみなされません。
- **終了フレームだけなら開始画像になる**：**開始フレーム**なしで**終了フレーム**を接続すると、ノードはその画像を、動かす画像として送ります。
- **1 つの項目に 2 つのバージョン**：Grok Imagine、Wan 2.6、Wan 2.7、HappyHorse 1.1 は、モデルの一覧にそれぞれ 1 回だけ表示されます。ノードは、画像が接続されているかどうかに応じて、そのモデルのテキストから動画版か画像から動画版を使います。

## 入力
動画生成には、左端に 12 個の入力があります。各入力が受け付けるのは表に挙げた種類のノードだけで、合わない接続はエディターが受け付けません。選んだモデルが使えない入力は、無効として表示されます。入力をクリックすると、接続されているものの確認、接続先のノードへの移動、接続の解除、対応する新しいノードの追加ができます。

| 入力 | 接続できるノード | 説明 |
| --- | --- | --- |
| **プロンプト** | テキスト、**プロンプト**（Prompt）、**脚本生成**（Generate Script）、**テキストを結合**（Combine Text）などのテキスト系ノードと、ピッカー | クリップの説明です。 |
| **ネガティブ** | テキスト系ノード | モデルに避けてほしいものです。一部のモデルは、これを本来のネガティブプロンプトとして受け取ります。それ以外のモデルでは、Nodaro がプロンプトに「Avoid:」という行として追加します。 |
| **開始フレーム** | **画像アップロード**（Upload Image）、画像生成、**画像修正**（Modify Image）などの画像系ノード | クリップの最初のフレームです。 |
| **終了フレーム** | 画像系ノード | クリップの最後のフレームです。終了フレームに対応するモデルで使えます。 |
| **画像リファレンス** | 画像系ノード（複数を同時に接続可） | リファレンス画像に対応するモデルで使う、リファレンス画像です。順番が重要です。設定パネルでドラッグして並べ替えます。 |
| **動画リファレンス** | 動画系ノード（複数を同時に接続可） | Seedance 2、Seedance 2.5、Hailuo 3、Wan 3.0、Gemini Omni 用のリファレンスクリップです。Seedance 2.5 と Gemini Omni では、ここに接続したクリップを編集することもできます。 |
| **オーディオ** | オーディオ系ノード | 完成したクリップのサウンドトラックです。LTX 2.3 Pro で開始フレームがない場合は、代わりにこのオーディオをもとにクリップを作ります（オーディオから動画）。 |
| **オーディオリファレンス** | オーディオ系ノード（複数を同時に接続可） | 生成そのものに影響するオーディオです。Seedance 2 ファミリー、Hailuo 3、Wan 3.0 で使えます。セリフの音声を接続すると、Seedance 2 と Hailuo 3 は話者の口の動きをその音声に合わせます。 |
| **アセット** | **キャラクターアセット**（Character Asset）、**ロケーションアセット**（Location Asset）、**オブジェクト／小道具アセット**（Object/Props Asset）、**動物／クリーチャーアセット**（Animal/Creature Asset）、**顔を作成**（Create Face）の各ノード | 見た目を固定するためのアセットです。承認済みの画像と説明がプロンプトと一緒に送られます。プロンプトの中で `@` を使ってメンションすることもできます。 |
| **ルック** | **カメラモーション**（Camera Motion）、**レンズ**（Lens）、**ライティング**（Lighting）、**フレーミング**（Framing）、**ムード**（Mood）、**スタイル**（Style）、**時間表現**（Temporal）、**トランジション**（Transition）などのカメラ・ルック系ピッカー | 各ピッカーの言い回しが、プロンプトに追加されます。 |
| **エレメント** | **人物**（Person）、**ポーズ**（Pose）、**動物**（Animal）、**乗り物**（Vehicle）、**スタイリング**（Styling）、**手に持つ小道具**（Held Prop）などの被写体系ピッカー | 各ピッカーの言い回しが、プロンプトに追加されます。 |
| **設定** | [**アスペクト比**（Aspect Ratio）](https://nodaro.ai/docs/nodes/settings/aspect-ratio)、[**長さ**（Duration）](https://nodaro.ai/docs/nodes/settings/duration)、[**プロバイダー**（Provider）](https://nodaro.ai/docs/nodes/settings/provider)、[**モーション**（Motion）](https://nodaro.ai/docs/nodes/settings/motion)の各ノード（1 つの入力で 4 種類すべてを接続可） | ノードの実行時に、ノードのアスペクト比、長さ、モデルを設定します。モーションノードは、プロンプトに語句を追加します。[「設定」入力](#settings-input)を参照してください。 |

出力の**動画**は、生成されたクリップの URL です。いくつのノードにでも同時に渡せます。

**オーディオ**と**オーディオリファレンス**は、役割が異なります。**オーディオ**は、完成したクリップにサウンドトラックとして重ねられます。**オーディオリファレンス**はモデルに渡され、生成される内容そのものを変えます。

### 直接入力したプロンプトと接続したプロンプト
**プロンプト**に接続したプロンプトは、ノードに直接入力したプロンプトの後に追加されます。直接入力したプロンプトで、接続したノードを `{Subject}` のような変数として指定している場合、接続したテキストは変数の位置にだけ入ります。接続したプロンプトを追加しないようにするには、設定パネルの**プロンプト挿入**にある**プロンプトを挿入**をオフにします。

**プロンプト**への接続がグレーの破線になるのは、ノードが接続したテキストを使わない場合だけです。グレーの接続にポインターを合わせると、理由が表示されます。

- **プロンプトを挿入**がオフで、直接入力したプロンプトが、接続したノードを変数として指定していません。接続には「未使用：『プロンプトを挿入』がオフです」と表示されます。
- **プロンプト**に複数のテキストノードが接続されています。ノードは最後に接続したものを使い、それより前の接続はグレーになります。これらの接続には「未使用：後から接続したテキストノードに置き換えられています」と表示されます。直接入力したプロンプトが変数として指定しているテキストノードは、常に使われます。

### 「設定」入力
**設定**入力は、[アスペクト比](https://nodaro.ai/docs/nodes/settings/aspect-ratio)、[長さ](https://nodaro.ai/docs/nodes/settings/duration)、[プロバイダー](https://nodaro.ai/docs/nodes/settings/provider)、[モーション](https://nodaro.ai/docs/nodes/settings/motion)の各ノードを受け付けます。ノードの実行時には、接続したアスペクト比、長さ、プロバイダーの各ノードが、ノード自体の設定を 1 つずつ置き換えます。

| 接続したノード | 置き換える設定 | 実行時の値 |
| --- | --- | --- |
| **アスペクト比** | **アスペクト比** | モデルが作れる最も近い比率です。たとえば Seedance 2 では、`4:5` は `3:4` で実行されます。 |
| **長さ** | **長さ（秒）** | モデルが作れる最も近い長さです。同じだけ近い長さが 2 つある場合は、短いほうになります。たとえば 60 秒は、Seedance 2 では 15 秒、VEO 3.1 では 8 秒で実行されます。 |
| **プロバイダー** | **プロバイダー** | プロバイダーノードのモデルです。このノードで実行できる動画モデルである必要があります。 |

**モーション**ノードは、どの設定も置き換えません。接続したピッカーの言い回しと一緒に、動きの量についての語句をプロンプトの末尾に追加します。たとえば**ダイナミック**は、`dynamic, energetic motion with fast, pronounced movement` を追加します。この語句は、ルックのピッカーと同じように、**プロンプト挿入**の**ルックを挿入**スイッチに従います。モーションノードを接続しても、ノード自体の**モーションヒント（プロンプトに挿入）**の設定はオフにならず、2 つがまとめられることもありません。どちらか一方を使ってください。[モーション](https://nodaro.ai/docs/nodes/settings/motion)を参照してください。

- **同じ種類のノードが複数ある場合**：長さノード 2 つなど、同じ種類のノードが 2 つ接続されている場合は、最後に接続したものが使われます。
- **ノードが実行できないモデル**：画像モデルを設定したプロバイダーノードは拒否されます。ノード上のモデルのチップが赤くなり、**実行**が無効になって、その理由が表示されます。たとえば「このノードでは Nano Banana を実行できません。プロバイダー ノードで、このノードのモデルを選択してください。」と表示されます。ワークフローの実行などで、実行がこのノードまで進んだ場合は、料金がかかる前にそこで止まり、エラーにはプロバイダーノードの名前が示されます。
- **ノードの表示**：ノードの左上にあるチップに、実行に使われる値が表示されます。たとえば **16:9**、**8s**、**Seedance 2**、**ダイナミック**です。ノードの下のバーと設定パネルでは、接続したアスペクト比、長さ、プロバイダーに接続元のノードが表示され、そこでは変更できません。
- **料金**：**実行**ボタン、ワークフローの合計、実行の開始時に確保されるクレジットは、すべて接続したモデルと、モデルに合わせた長さで計算されます。モーションノードで料金は変わりません。設定が接続されている間は、**実行**の下に「接続した設定によって価格が変わる場合があります」という注記が表示されます。
- **自動調整と自動**：接続した比率は**自動調整**と**自動（画像に合わせる）**を置き換え、接続した長さは**自動**を置き換えます。

## 設定
以下の設定は、ほとんどのモデルで表示されます。設定パネルには、選んだモデルが対応している項目だけが表示されます。

| 設定 | 説明 |
| --- | --- |
| **プロバイダー** | 動画モデルです。新しいノードは、**Seedance 2.0 Fast** の 4 秒から始まります。一覧でモデルにポインターを合わせると、そのモデルが対応している機能を確認できます。 |
| **プロンプト** | プロンプトのテキストです。**プロンプト**入力に接続したプロンプトは、直接入力したテキストの後に追加されます。上限はモデルごとに異なり、Kling 2.6 の 1,000 文字から Seedance 2.5 の 30,000 文字までです。エディターには選んだモデルの上限までの残り文字数が表示され、上限を超えたテキストは切り捨てられます。 |
| **ネガティブプロンプト** | 避けたいものです。 |
| **長さ（秒）** | クリップの長さです。選べる値はモデルによって異なります。Seedance 2 ファミリーでは、**自動**を選ぶとモデルが長さを決めます。 |
| **解像度** | 出力の解像度です。解像度を選べるモデルで使えます。 |
| **アスペクト比** | クリップの形です。**自動調整**または**自動（画像に合わせる）**は、接続した画像に合わせます。 |
| **オーディオを生成** | モデルがサウンドトラックを作るかどうかです。サウンドのオン・オフを切り替えられるモデルで使えます。 |
| **フレームの調整** | 接続した開始フレームや終了フレームを、モデルに渡す前にどう整形するかです。[開始フレームと終了フレーム](#start-and-end-frames)を参照してください。 |
| **フレームの送信形式** | 接続したフレームを、本来のフレームとして送るか、リファレンス画像として送るかです。[開始フレームと終了フレーム](#start-and-end-frames)を参照してください。 |
| **ループトリミング** | 完成したクリップを、最もきれいにループする位置でカットします。[きれいなループを作る](#make-a-clean-loop)を参照してください。 |
| **モーションヒント（プロンプトに挿入）** | チェックを入れると、開始フレームの有無にかかわらず、動きの強さをプロンプトに追加します。**控えめ**、**中程度**（初期値）、**ダイナミック**から選びます。**設定**入力に接続した[モーション](https://nodaro.ai/docs/nodes/settings/motion)ノードは独自の語句を追加し、この設定をオフにしないため、どちらか一方を使ってください。 |
| **クリップを「…」のリファレンス動画として保存** | キャラクターを接続すると表示されます。完成したクリップに、入力した**バリエーションのラベル**を付けて、そのキャラクターのリファレンス動画に保存します。保存したクリップは、動画のリファレンスとして再利用できます。 |
| **前後のテキスト** | プロンプトの前後に必ず追加されるテキストです。ワークフローをアプリとして使う人には表示されません。[プロンプトの前後のテキスト](https://nodaro.ai/docs/concepts/prompt-pre-post-text)を参照してください。 |

**設定**入力に接続したプロバイダー、長さ、アスペクト比の各ノードは、ノードの実行時に**プロバイダー**、**長さ（秒）**、**アスペクト比**を置き換えます。接続したモーションノードは、設定を置き換える代わりに、プロンプトに語句を追加します。[「設定」入力](#settings-input)を参照してください。

![動画生成の設定パネル。Seedance 2.0 が選ばれ、モードの注記、プロンプト、ネガティブプロンプトが表示されています。](https://nodaro.ai/docs-media/screens/en/nodes/generate-video/settings-panel.light.webp)

### モデル別の設定
| モデル | 追加の設定 |
| --- | --- |
| VEO 3.1 Quality、Fast、Lite | **生成モード**：**フレーム指定**（デフォルト）か**リファレンスモード**です。リファレンスモードは、フレームの代わりに 1〜3 枚のリファレンス画像を使います。**シード（任意）**：10000〜99999 です。**オーディオを生成**：デフォルトでオンです。**プロンプトを英語に自動翻訳**：デフォルトでオンです。オフにすると、プロンプトが一字一句そのまま使われます。 |
| Seedance 2、Seedance 2 Fast、Seedance 2 Mini、Seedance 2.5 | **オーディオを生成（デフォルトでオン）**、**Web 検索を有効にする**、**NSFW コンテンツフィルター**です。パネル上部の注記に、接続した入力で決まるモードが表示されます。 |
| Hailuo 3 (minimax-h3) | **解像度**：**2K**（デフォルト）か **768P** です。768P のほうが、1 秒あたりの料金が安くなります。オーディオは常に生成されます。 |
| Wan 3.0、Wan 3.0 Prime | 環境音を生成する**オーディオを生成（デフォルトでオン）**です。初期値は 720p、**自動調整**です。 |
| Kling 2.6 | **サウンドを有効にする**です。サウンド付きのクリップは料金が高くなります。 |
| Kling 2.5 Turbo Pro、Kling 2.1 Master | **CFG スケール**：0（創造的）〜1（プロンプトに厳密に従う）です。 |
| Kling 3 Omni | **品質**（**スタンダード（720p）**または**プロ（1080p）**）と、**オーディオを生成**です。 |
| Grok Imagine | **解像度**（480p または 720p）と、**モード**（**ノーマル**、**ファン**、**スパイシー**）です。 |
| Bytedance Lite、Bytedance Pro | **カメラを固定**と**シード（-1 でランダム）**です。 |
| Hailuo 2.3、Hailuo 2.3 Pro | **解像度**：768P または 1080P です。1080P では、クリップは 6 秒にしかできません。 |
| Gemini Omni、Gemini Omni Flash | **ソースクリップのトリミング（秒、10 秒以内の範囲）**です。**動画リファレンス**に動画を接続すると表示されます。 |

### Kling 3.0 の設定
Kling 3.0 を選ぶと、設定パネルが**シーン**、**ショット**、**エレメント**の 3 つのタブに変わります。

- **シーン**には、モデル、**モード**（**プロ（1080p）**、**スタンダード（720p）**、**4K（ウルトラ HD）**）、**アスペクト比**、リップシンクしたセリフとサウンドのための**効果音**、長さ（3〜15 秒）があります。
- **ショット**には、**マルチショットモード**があります。クリップを 2〜6 個のショットに分け、ショットごとにプロンプトと長さを設定できます。合計は最大 15 秒です。マルチショットモードではサウンドが必須で、終了フレームは使えません。
- **エレメント**では、説明と 2〜4 枚のリファレンス画像を使って、名前付きのキャラクターやオブジェクトを定義できます。定義したものは、プロンプトの中で `@name` としてメンションできます。

## どのモデルを選ぶか
動画生成では、以下のすべてのモデルを実行できます。モデルをクリックすると、その設定、クレジットの料金、プロンプトのコツを確認できます。

| Model | Maker | Modes | Credits | Details |
| --- | --- | --- | --- | --- |
| [Hailuo 02 I2V Pro](https://nodaro.ai/docs/models/video/hailuo-02-i2v-pro) | MiniMax | Image to video, Text to video | 143 | Hailuo 02 Pro — strong photoreal motion, fixed 5-second clips. Supports end frame. |
| [minimax-h3](https://nodaro.ai/docs/models/video/minimax-h3) | MiniMax | Image to video, Text to video | from 230 | MiniMax Hailuo 3 — premium multimodal tier: first/last frame + image/video/audio references, native audio, 2K (default) or 768P output, 4-15s per-second pricing. |
| [Hailuo 2.3 Pro](https://nodaro.ai/docs/models/video/hailuo-2-3-pro) | MiniMax | Image to video | from 130 | Hailuo 2.3 Pro — newer Hailuo with 768P / 1080P resolutions. |
| [Hailuo 2.3 Standard](https://nodaro.ai/docs/models/video/hailuo-2-3-standard) | MiniMax | Image to video | from 75 | Cheaper Hailuo 2.3 tier — good baseline quality. |
| [Hailuo 02 Standard](https://nodaro.ai/docs/models/video/hailuo-02-standard) | MiniMax | Image to video, Text to video | from 75 | Hailuo 02 Standard — economical option with end-frame support. |
| [VEO 3.1 Quality](https://nodaro.ai/docs/models/video/veo-3-1-quality) | Google | Image to video, Text to video | from 930 | Google VEO 3.1 Quality — premium cinematic video. 4/6/8s clips, optional end frame, native audio. No reference-to-video mode (Fast/Lite only). Flat per-generation pricing across durations. |
| [VEO 3.1 Fast](https://nodaro.ai/docs/models/video/veo-3-1-fast) | Google | Image to video, Text to video | from 150 | VEO 3.1 Fast — cheaper VEO 3.1 tier, 4/6/8s with audio. Good balance for most uses. Flat per-generation pricing across durations. |
| [VEO 3.1 Lite](https://nodaro.ai/docs/models/video/veo-3-1-lite) | Google | Image to video, Text to video | from 75 | VEO 3.1 Lite — most cost-effective VEO tier for high-volume generation. 4/6/8s with audio, supports first+last frame. |
| [Gemini Omni](https://nodaro.ai/docs/models/video/gemini-omni) | Google | Image to video, Text to video | from 230 | Google multimodal video with native audio; text/image-to-video + video-edit. |
| [Gemini Omni Flash](https://nodaro.ai/docs/models/video/gemini-omni-flash) | Google | Image to video, Text to video | from 160 | Google Gemini Omni Flash — faster/cheaper Omni tier: multimodal video with native audio, text/image-to-video + video-edit. |
| [Kling 2.6](https://nodaro.ai/docs/models/video/kling-2-6) | Kuaishou | Image to video, Text to video | from 138 | Kling 2.6 I2V — strong motion realism. 5s/10s, optional native audio. |
| [Kling 2.5 Turbo Pro](https://nodaro.ai/docs/models/video/kling-2-5-turbo-pro) | Kuaishou | Image to video, Text to video | from 110 | Faster Kling — good quality at lower cost. Supports end frame. |
| [Kling 3.0](https://nodaro.ai/docs/models/video/kling-3-0) | Kuaishou | Image to video, Text to video | from 270 | Premium Kling 3.0 — variable 3-15s duration, native audio, 720P/1080P. |
| [Kling 2.1 Master](https://nodaro.ai/docs/models/video/kling-2-1-master) | Kuaishou | Image to video | from 400 | Master tier I2V — strong cinematic quality. |
| [Kling 3 Omni](https://nodaro.ai/docs/models/video/kling-3-omni) | Kuaishou | Image to video | from 250 | Kling 3 Omni — 3-15s, 720p/1080p, end frame + reference images, native audio. |
| [Grok Imagine (I2V)](https://nodaro.ai/docs/models/video/grok-imagine-i2v) | xAI | Image to video | from 50 | Grok image-to-video — stylized motion. Up to 15s. |
| [Grok Imagine Video 1.5](https://nodaro.ai/docs/models/video/grok-imagine-video-1-5) | xAI | Image to video | from 295 | Grok Imagine 1.5 image-to-video — 1–15s, 480p/720p, per-second pricing. Requires an input image. |
| [Seedance 2](https://nodaro.ai/docs/models/video/seedance-2) | Bytedance | Image to video, Text to video | from 230 | Seedance 2 — premium tier with native audio. Per-second pricing by resolution. |
| [Seedance 2 Fast](https://nodaro.ai/docs/models/video/seedance-2-fast) | Bytedance | Image to video, Text to video | from 180 | Cheaper / quicker Seedance 2 tier. |
| [Seedance 2 Mini](https://nodaro.ai/docs/models/video/seedance-2-mini) | Bytedance | Image to video, Text to video | from 120 | Budget Seedance 2 tier — 480p/720p only, per-second pricing by resolution. |
| [Seedance 2.5](https://nodaro.ai/docs/models/video/seedance-2-5) | Bytedance | Image to video, Text to video | from 340 | Seedance 2.5 — up to 30s in one shot, native audio, wide multimodal references. 480p/720p/1080p. |
| [Bytedance Lite I2V](https://nodaro.ai/docs/models/video/bytedance-lite-i2v) | Bytedance | Image to video, Text to video | 57 | Cheapest Bytedance video tier with end-frame support. |
| [Bytedance Pro I2V](https://nodaro.ai/docs/models/video/bytedance-pro-i2v) | Bytedance | Image to video, Text to video | 175 | Pro Bytedance video tier — better quality. |
| [Bytedance Pro Fast I2V](https://nodaro.ai/docs/models/video/bytedance-pro-fast-i2v) | Bytedance | Image to video | 90 | Faster Bytedance Pro variant. |
| [Wan 3.0](https://nodaro.ai/docs/models/video/wan-3-0) | Alibaba | Image to video, Text to video | from 160 | Wan 3.0 — multimodal: first/last frame or image/video/audio references, native audio, 2-30s at 480p/720p/1080p. |
| [Wan 3.0 Prime](https://nodaro.ai/docs/models/video/wan-3-0-prime) | Alibaba | Image to video, Text to video | from 250 | Wan 3.0 Prime — Alibaba's high-speed Wan 3.0 tier: same multimodal surface and 2-30s range, faster turnaround at a higher per-second rate. |
| [Wan 2.6 I2V](https://nodaro.ai/docs/models/video/wan-2-6-i2v) | Alibaba | Image to video | from 175 | Wan 2.6 image-to-video — 5/10/15s at 720p/1080p. |
| [Wan 2.2 Turbo](https://nodaro.ai/docs/models/video/wan-2-2-turbo) | Alibaba | Image to video, Text to video | from 100 | Cheap, fast Wan turbo — 5s. Serves both i2v and t2v under one id. |
| [Wan 2.6](https://nodaro.ai/docs/models/video/wan-2-6) | Alibaba | Video to video, Text to video | from 175 | Wan 2.6 — text-to-video and video-to-video under a single id. |
| [Wan 2.7 I2V](https://nodaro.ai/docs/models/video/wan-2-7-i2v) | Alibaba | Image to video | 188 | Wan 2.7 image-to-video — 2–15s at 720p/1080p, supports start+end frame. |
| [Wan 2.7 T2V](https://nodaro.ai/docs/models/video/wan-2-7-t2v) | Alibaba | Text to video | 188 | Wan 2.7 text-to-video — 2–15s at 720p/1080p. |
| [LTX 2.3 Pro](https://nodaro.ai/docs/models/video/ltx-2-3-pro) | Lightricks | Image to video, Text to video | from 40 | Lightricks LTX 2.3 Pro — text/image/audio→video up to 4K, 6/8/10s, end-frame interpolation. |
| [LTX 2.3 Fast](https://nodaro.ai/docs/models/video/ltx-2-3-fast) | Lightricks | Image to video, Text to video | from 180 | Lightricks LTX 2.3 Fast — text/image→video up to 20s at 1080p (6/8/10s at 2K and 4K). No audio input, no extend. |
| [HappyHorse 1.1](https://nodaro.ai/docs/models/video/happyhorse-1-1) | HappyHorse | Text to video | 282 | HappyHorse 1.1 text-to-video — 3–15s at 720p/1080p, 9 aspect ratios incl. 21:9/9:21, per-second pricing. |
| [HappyHorse 1.1 I2V](https://nodaro.ai/docs/models/video/happyhorse-1-1-i2v) | HappyHorse | Image to video | 282 | HappyHorse 1.1 image-to-video — 3–15s at 720p/1080p, aspect ratio inferred from input image, per-second pricing. |
| [HappyHorse 1.1 Ref2V](https://nodaro.ai/docs/models/video/happyhorse-1-1-ref2v) | HappyHorse | Image to video | 282 | HappyHorse 1.1 reference-to-video — 1–9 reference images, 3–15s at 720p/1080p, per-second pricing. |
| [Runway Gen-3](https://nodaro.ai/docs/models/video/runway-gen-3) | Runway | Image to video, Text to video | 30 | Runway Gen-3. 5/10s at 720p/1080p. |

- **Seedance 2.0 Fast**：デフォルトです。低価格で、サウンドはオン、リファレンスに対応しています。試行錯誤に使います。
- **VEO 3.1 Fast**：価格と品質のバランスがよいモデルです。ネイティブオーディオに対応し、4 秒、6 秒、8 秒のどれでも同じ料金です。
- **VEO 3.1 Quality** と **Kling 3.0**：上質なシネマティックショット向けです。Kling 3.0 は、マルチショットのクリップと 3〜15 秒の長さにも対応しています。
- **Seedance 2** と **Seedance 2.5**：リファレンスへの対応が最も幅広く、画像、動画、オーディオを組み合わせて使えます。Seedance 2.5 は、1 回の実行で最大 30 秒を作れ、クリップの編集もできます。
- **Wan 3.0**：2〜30 秒の範囲で、1 秒単位で長さを選べます。リファレンスと環境音に対応しています。
- **Hailuo 3 (minimax-h3)**：2K の上質なマルチモーダルのクリップを作ります。リファレンスに対応し、オーディオは常にオンです。
- **VEO 3.1 Lite**、**Wan 2.2 Turbo**、**Bytedance Lite**：最も安くクリップを作れます。まとめて作るときや下書きに使います。

すべてのモデルの比較は、[モデルの選び方](https://nodaro.ai/docs/guides/choosing-models)を読んでください。

### 1 つの開始フレーム、3 つのモデル
以下の 3 本のクリップは、[画像生成](https://nodaro.ai/docs/nodes/image/generate-image)で作った同じ画像から始まり、同じプロンプトを使って、サウンドをオンにして生成しています。変えたのはモデルだけです。

```
Slow dolly in toward the boat as it drifts, mist rolling across the water, gulls in the distance, gentle lapping waves
```

Video: [VEO 3.1 Fast、720p、6 秒](https://nodaro.ai/docs-media/examples/first-workflow/boat-veo.mp4)
Video: [Seedance 2.5、480p、8 秒](https://nodaro.ai/docs-media/examples/generate-video/boat-seedance-2-5.mp4)
Video: [Gemini Omni Flash、720p、6 秒](https://nodaro.ai/docs-media/examples/generate-video/boat-omni-flash.mp4)

- **VEO 3.1 Fast** は、開始フレームの金色の光を保ったまま、ゆっくりとプッシュインし、プロンプトにあるカモメを加えました。
- **Seedance 2.5** は、開始フレームに最も忠実で、動きも最も穏やかでした。480p なので映像も最もソフトですが、下書きなら問題ありません。
- **Gemini Omni Flash** は、1.5 秒ほどで開始フレームから離れました。光は寒色寄りになり、山の形も変わりました。

クリップが開始フレームを正確に引き継ぐ必要がある場合は、その先の作業に進む前に、各テイクの最初の数秒を確認してください。最初のモデルが開始フレームからずれるときは、別のモデルを試してください。

## モデル別の長さと解像度
選べる長さと解像度は、モデルによって異なります。各モデルのページには、すべての値とアスペクト比が記載されています。

| モデル | 長さ | 解像度 | 終了フレーム | リファレンス |
| --- | --- | --- | --- | --- |
| [Seedance 2](https://nodaro.ai/docs/models/video/seedance-2) | 4〜15 秒、または自動 | 480p、720p、1080p、4K | 対応 | 画像 9 枚、動画 3 本、オーディオ 3 本 |
| [Seedance 2 Fast](https://nodaro.ai/docs/models/video/seedance-2-fast) | 4〜15 秒、または自動 | 480p、720p | 対応 | 画像 9 枚、動画 3 本、オーディオ 3 本 |
| [Seedance 2 Mini](https://nodaro.ai/docs/models/video/seedance-2-mini) | 4〜15 秒、または自動 | 480p、720p | 対応 | 画像 9 枚、動画 3 本、オーディオ 3 本 |
| [Seedance 2.5](https://nodaro.ai/docs/models/video/seedance-2-5) | 4〜30 秒、または自動 | 480p、720p、1080p | 対応 | 画像 30 枚、動画 10 本、オーディオ 10 本 |
| [Hailuo 3 (minimax-h3)](https://nodaro.ai/docs/models/video/minimax-h3) | 4〜15 秒 | 2K、768P | 対応 | 画像 9 枚、動画 3 本、オーディオ 3 本 |
| [VEO 3.1 Quality](https://nodaro.ai/docs/models/video/veo-3-1-quality) | 4、6、8 秒 | 720p、1080p、4K | 対応 | なし |
| [VEO 3.1 Fast](https://nodaro.ai/docs/models/video/veo-3-1-fast) | 4、6、8 秒 | 720p、1080p、4K | 対応 | 画像 3 枚まで |
| [VEO 3.1 Lite](https://nodaro.ai/docs/models/video/veo-3-1-lite) | 4、6、8 秒 | 720p、1080p、4K | 対応 | 画像 3 枚まで |
| [Gemini Omni](https://nodaro.ai/docs/models/video/gemini-omni) | 4、6、8、10 秒 | 720p、1080p、4K | 非対応 | 入力 7 件（動画は 2 件分） |
| [Gemini Omni Flash](https://nodaro.ai/docs/models/video/gemini-omni-flash) | 4、6、8、10 秒 | 720p、1080p、4K | 非対応 | 入力 7 件（動画は 2 件分） |
| [Kling 3.0](https://nodaro.ai/docs/models/video/kling-3-0) | 3〜15 秒 | 720p、1080p、4K | 対応 | エレメント |
| [Kling 3 Omni](https://nodaro.ai/docs/models/video/kling-3-omni) | 3〜15 秒 | 720p、1080p | 対応 | 画像 7 枚まで |
| [Kling 2.6](https://nodaro.ai/docs/models/video/kling-2-6) | 5、10 秒 | — | 非対応 | なし |
| [Kling 2.5 Turbo Pro](https://nodaro.ai/docs/models/video/kling-2-5-turbo-pro) | 5、10 秒 | — | 対応 | なし |
| [Kling 2.1 Master](https://nodaro.ai/docs/models/video/kling-2-1-master) | 5、10 秒 | — | 非対応 | なし |
| [Wan 3.0](https://nodaro.ai/docs/models/video/wan-3-0)、[Wan 3.0 Prime](https://nodaro.ai/docs/models/video/wan-3-0-prime) | 2〜30 秒 | 480p、720p、1080p | 対応 | 画像 10 枚、動画 5 本、オーディオ 5 本 |
| [Wan 2.7](https://nodaro.ai/docs/models/video/wan-2-7-i2v) | 2〜15 秒 | 720p、1080p | 対応 | なし |
| [Wan 2.6](https://nodaro.ai/docs/models/video/wan-2-6-i2v) | 5、10、15 秒 | 720p、1080p | 非対応 | なし |
| [Wan 2.2 Turbo](https://nodaro.ai/docs/models/video/wan-2-2-turbo) | 5 秒 | 480p、720p | 非対応 | なし |
| [HappyHorse 1.1](https://nodaro.ai/docs/models/video/happyhorse-1-1-i2v) | 3〜15 秒 | 720p、1080p | 非対応 | なし |
| [HappyHorse 1.1 Ref2V](https://nodaro.ai/docs/models/video/happyhorse-1-1-ref2v) | 3〜15 秒 | 720p、1080p | 非対応 | 画像 1〜9 枚 |
| [Hailuo 2.3 Pro](https://nodaro.ai/docs/models/video/hailuo-2-3-pro)、[Hailuo 2.3 Standard](https://nodaro.ai/docs/models/video/hailuo-2-3-standard) | 6、10 秒 | 768P、1080P | 非対応 | なし |
| [Hailuo 02 Standard](https://nodaro.ai/docs/models/video/hailuo-02-standard) | 6、10 秒 | 512P、768P | 対応 | なし |
| [Hailuo 02 I2V Pro](https://nodaro.ai/docs/models/video/hailuo-02-i2v-pro) | 5 秒 | — | 対応 | なし |
| [Bytedance Lite I2V](https://nodaro.ai/docs/models/video/bytedance-lite-i2v) | 5、10 秒 | 480p、720p、1080p | 対応 | なし |
| [Bytedance Pro I2V](https://nodaro.ai/docs/models/video/bytedance-pro-i2v) | 5、10 秒 | 480p、720p、1080p | 非対応 | なし |
| [Bytedance Pro Fast I2V](https://nodaro.ai/docs/models/video/bytedance-pro-fast-i2v) | 5、10 秒 | 720p、1080p | 非対応 | なし |
| [Grok Imagine (I2V)](https://nodaro.ai/docs/models/video/grok-imagine-i2v) | 6、10 秒 | 480p、720p | 非対応 | リファレンス画像 |
| [Grok Imagine Video 1.5](https://nodaro.ai/docs/models/video/grok-imagine-video-1-5) | 1〜15 秒 | 480p、720p | 非対応 | なし |
| [LTX 2.3 Pro](https://nodaro.ai/docs/models/video/ltx-2-3-pro) | 6、8、10 秒 | 1080p、2K、4K | 対応 | なし |
| [LTX 2.3 Fast](https://nodaro.ai/docs/models/video/ltx-2-3-fast) | 1080p では 6〜20 秒、2K と 4K では 6、8、10 秒 | 1080p、2K、4K | 対応 | なし |
| [Runway Gen-3](https://nodaro.ai/docs/models/video/runway-gen-3) | 5、10 秒 | 720p、1080p | 非対応 | なし |

「—」は、そのモデルでは解像度を選べないことを示します。

**アスペクト比**：VEO 3.1、Gemini Omni、LTX 2.3 は、16:9 か 9:16 のクリップを作ります。Seedance 2 ファミリーでは、さらに 1:1、4:3、3:4、21:9 と**自動調整**を選べます。**自動調整**はデフォルトで、接続した画像に合わせます。Hailuo 3 と Wan 3.0 でも、**自動調整**がデフォルトです。Hailuo 3 か Wan 3.0 でテキストだけからクリップを作る場合は、比率を選ばない限り 16:9 でレンダリングされます。HappyHorse 1.1 では、テキストから動画と Ref2V のクリップで、4:5、5:4、21:9、9:21 を含む 9 種類の比率を選べます。画像から動画では、入力画像の比率に従います。

**VEO 3.1 の 4K**：VEO はクリップを 1080p で作り、同じ実行の中で 4K にアップスケールします。料金は 4K の価格です。**Gemini Omni の 4K** は、無料プランでは使えません。

## 開始フレームと終了フレーム
**開始フレーム**に画像を接続すると、クリップはその画像から始まります。**終了フレーム**に 2 枚目の画像を接続すると、クリップはその画像で終わります。終了フレームに対応しているのは、次のモデルです。

- VEO 3.1 Quality、Fast、Lite。
- Seedance 2 ファミリーと Seedance 2.5。
- Hailuo 3、Hailuo 02 Standard、Hailuo 02 I2V Pro。
- Kling 3.0、Kling 3 Omni、Kling 2.5 Turbo Pro。
- Wan 2.7、Wan 3.0、Wan 3.0 Prime。
- Bytedance Lite。
- LTX 2.3 Pro、LTX 2.3 Fast。

それ以外のモデルは、終了フレームを無視します。

### フレームの調整
フレームのサイズが、モデルがレンダリングするサイズとぴったり同じでない場合、モデルがフレームの形を変えます。モデルによっては、この変形がクリップの 2 フレーム目から起こります。すると、最初のフレームは自分の画像のままで、残りのクリップはわずかに縦長または横長になります。**フレームの調整**は、フレームを送る前にサイズを整えます。

| 値 | 説明 |
| --- | --- |
| **出力サイズに合わせる**（デフォルト） | 選んだ解像度とアスペクト比でモデルがレンダリングするピクセルサイズに、フレームをぴったり合わせます。 |
| **アスペクト比に合わせる** | 最小限の変更で、アスペクト比だけを補正します。 |
| **元のまま** | フレームに手を加えずに送ります。 |

選んだモデル、解像度、比率に対するサイズを Nodaro が把握している場合は、設定の下に 720×1280 のようにそのサイズが表示されます。画像の形が目標の形から 5% を超えてずれている場合は、まず画像の中央を目標の比率で切り抜いてから、サイズを変更します。たとえば、9:16 のクリップに正方形の写真を使う場合です。被写体がつぶれることはありません。Nodaro が計測していない組み合わせでは、フレームには手を加えません。

### フレームの送信形式
| 値 | 説明 |
| --- | --- |
| **自動**（デフォルト） | モデルに合った最適な方法を選びます。選択肢には、どちらになるかが**自動（フレームとして）**または**自動（リファレンス画像として）**と表示されます。 |
| **フレーム** | 常に本来の開始フレームとして送ります。 |
| **リファレンス画像** | 常に画像をリファレンスとして送り、プロンプトの中でその画像を冒頭のフレームとして指定します。 |

Seedance 2.0 ファミリー（Fast、標準、Mini）は、本来の開始フレームを約 2% ズームし、6 フレーム以内に明るさが落ちます。リファレンス画像として送ると、同じモデルでも最初のフレームから見た目が保たれます。Nodaro が計測したほかのすべてのモデルは、本来のフレームとして送ったほうが冒頭のフレームを忠実に再現します。そのため、**自動**ではそれらのモデルにフレームとして送ります。リファレンス画像を受け付けないモデルでは、この設定は表示されません。

制限が 2 つあります。1 つ目に、フレームを入れるために自分のリファレンス画像が外されることはありません。フレームを加えるとモデルの画像の上限を超える場合、フレームはフレームのまま送られます。2 つ目に、リクエストにすでにリファレンス画像がある場合、いくつかのモデルは本来の開始フレームを保てません。Seedance と Wan はフレームをリファレンスの一覧に移し、Hailuo 3 はリファレンスモードに切り替わり、VEO 3.1 は終了フレームを外します。

## リファレンス：画像、動画、オーディオ
リファレンスは、特定のフレームを固定せずに、何を映像に含めるかをモデルに伝えます。**画像リファレンス**、**動画リファレンス**、**オーディオリファレンス**に接続します。モデルごとの上限は、[上の表](#lengths-and-resolutions-by-model)にあります。リファレンスに対応していないモデルは、リファレンスを無視します。

- **Seedance 2 ファミリーと Hailuo 3**：フレームとリファレンスを一緒に接続できます。リファレンスがない場合、フレームは正確な最初と最後のフレームになります。リファレンスを 1 つでも接続すると、フレームはリファレンスのセットに加わり、プロンプトの中で冒頭または末尾のフレームとして指定されます。パネルには決まったモードが表示され、使われない入力がある場合は警告が表示されます。
- **Seedance 2.5**：画像は最大 30 枚、動画は 10 本、オーディオクリップは 10 本です。リファレンス動画は 1 本ごとに 2〜30 秒で、合計でも 30 秒以内である必要があります。リファレンスオーディオは、1 本あたり最大 30 秒です。
- **Seedance 2 Fast**：リファレンスオーディオは、1 本ごとに 15.2 秒以下である必要があります。
- **Hailuo 3**：リファレンス動画は 1 本ごとに 2〜15 秒で、合計 15 秒までです。リファレンスオーディオは 1 本あたり最大 15 秒で、画像か動画のリファレンスと一緒に使う必要があります。オーディオだけでは受け付けられません。
- **Wan 3.0**：画像は最大 10 枚、動画は 5 本、オーディオクリップは 5 本です。動画とオーディオのクリップは 1 本ごとに 1〜15 秒で、種類ごとに合計 15 秒までです。リファレンス動画を使う場合は、リファレンスと出力の長さの合計を 30 秒以下に収める必要があります。開始フレームや終了フレームは、リファレンスの一覧の、自分の画像の後ろに加わります。
- **VEO 3.1 Fast と Lite**：リファレンス画像を接続すると、開始フレームの有無にかかわらず、VEO はリファレンスモードに切り替わります。リファレンスモードでは、常に 8 秒のクリップが作られます。VEO の料金は 4 秒、6 秒、8 秒で同じなので、費用は変わりません。VEO が受け付ける画像は最大 3 枚です。開始フレームが 1 枚目になり、残りをリファレンスが埋めます。このモードでは、接続した終了フレームは使われません。VEO 3.1 Quality にはリファレンスモードがないため、リファレンスの入力は無効になります。
- **Gemini Omni と Gemini Omni Flash**：入力は最大 7 件です。開始フレームとリファレンス画像はそれぞれ 1 件、動画は 2 件として数えます。開始フレームがある場合、リファレンスはフレームではなく、見た目を保つためのリファレンスとして働きます。上限を超えた入力は使われず、その数がノードに表示されます。
- **HappyHorse 1.1 Ref2V** は、1〜9 枚のリファレンス画像を受け付けます。**Kling 3 Omni** は最大 7 枚です。

これらの長さの制限のほとんどは実行の開始前に確認されるため、制限を満たさないクリップでクレジットがかかることはありません。Wan 3.0 は例外で、リファレンス動画の制限を実行中に確認し、クリップが長すぎる場合は確保したクレジットを返還します。長いクリップは、先に[**動画のトリミング**（Trim Video）](https://nodaro.ai/docs/nodes/video/trim-video)で短くしてください。

### プロンプトでリファレンスを指定する
リファレンスに対応するモデルでは、プロンプトの中の語句を特定のリファレンスに結び付けて、そのリファレンスを結果に反映させることができます。語句を置く位置に、トークンを入力します。プロンプトエディターで `@` を入力すると、候補にトークンが表示されます。

| トークン | 置き換わる内容 | 用途 |
| --- | --- | --- |
| `{image:1:person}` | the person from `@image_1` | 被写体をリファレンス画像 1 に結び付ける |
| `{image:2:jacket}` | the jacket from `@image_2` | アイテムをリファレンス画像 2 に結び付ける |
| `{image:1}` | the subject in `@image_1` | 名詞を付けずに結び付ける |
| `{video:1:clip}` | the clip from `@video_1` | リファレンス動画 1 に結び付ける |
| `{audio:1:voice}` | the voice from `@audio_1` | リファレンスオーディオ 1 に結び付ける |

たとえば、リファレンス画像を 2 枚接続している場合、`circle {image:1:person} wearing {image:2:jacket} for a 360 spin` というプロンプトは「circle the person from @image_1 wearing the jacket from @image_2 for a 360 spin」になります。

- **番号の付け方**：画像の番号は、まず**画像リファレンス**の画像を順に数え、次に**アセット**入力のアセットを数えます。リファレンス画像が 1 枚で、オブジェクトのアセットを接続している場合、そのオブジェクトは `{image:2}` です。動画とオーディオには、それぞれ別の番号が付きます。
- **フレームの番号は自動で付く**：開始フレームと終了フレームは自分の画像の後に並び、プロンプトの中で冒頭または末尾のフレームとして指定されます。フレームのトークンを書く必要はありません。
- **範囲外の番号はただのテキストになる**：リファレンスが 2 つのノードでは、`{image:5:ghost}` は「ghost」になります。
- **リファレンスに対応していないモデル**では、すべてのトークンがラベルの語だけに置き換わるので、プロンプトは自然な文章のままです。

## サウンド
多くのモデルは、映像と一緒にオーディオトラックを作ります。制御の方法は、モデルによって異なります。

- **VEO 3.1** は、プロンプトからサウンドを作ります。デフォルトでオンです。無音のクリップにするには、**オーディオを生成**をオフにします。
- **Seedance 2 ファミリーと Wan 3.0** は、デフォルトでサウンドを作ります。**オーディオを生成（デフォルトでオン）**でオフにできます。
- **Hailuo 3** は、常にサウンドを作ります。リファレンスオーディオを接続すると、口の動きをその音声に合わせます。
- **Gemini Omni** は、毎回の実行でサウンドトラックを作り、その内容はプロンプトの指示に従います。たとえば「Sound design: gentle breeze, distant bird chirps」のように書きます。サウンドはオフにできず、セリフも話しません。
- **Kling 2.6** は、**サウンドを有効にする**がオンのときだけサウンドを作ります。**Kling 3.0** には**効果音**があります。Kling は、プロンプトの中でセリフを引用符で囲むと、そのセリフを話します。たとえば `[Anna: warm calm voice]: "good morning"` のように書きます。Kling 2.6 が話せるのは英語と中国語です。それ以外の言語は、モデルが英語に翻訳します。
- **Kling 3 Omni** は、料金にオーディオが含まれています。**オーディオを生成**のスイッチがあります。

自分のサウンドトラックを使うには、**オーディオ**入力に接続します。声や音楽にモデルを反応させたい場合は、代わりに**オーディオリファレンス**に接続します。

## クリップを編集する
Seedance 2.5 と Gemini Omni は、**動画リファレンス**に接続したクリップを変更できます。

**Seedance 2.5 の場合**、モデルはプロンプトをもとに、その実行がクリップをリファレンスとして使う通常の生成なのか、クリップの編集なのかを判断します。編集とは、たとえば「remove the sign」や「make it black and white」のような指示です。編集では、元のクリップのアスペクト比と長さが保たれます。モデルがプロンプトを編集と判断したのに、設定で別の比率や長さを指定していた場合は、Nodaro が編集に必要な値でもう一度実行を送信します。そのため、エラーではなく、編集されたクリップを受け取れます。最初から編集として依頼するには、**アスペクト比**を**自動調整**に、**長さ**を**自動**に設定します。元のクリップの長さは 4〜30 秒である必要があります。標準プリセットの**動画を編集**を使うと、これらがすべて設定されます。

**Gemini Omni** と Gemini Omni Flash の場合、クリップを接続するとノードが動画の編集に切り替わります。クリップは最大 10 秒の範囲にトリミングされ、その範囲は**ソースクリップのトリミング**で設定します。長さはクリップに合わせて決まり、動画の編集は 1 回の実行ごとの定額料金です。

## きれいなループを作る
**ループトリミング**は、クリップが最もきれいに先頭へつながるフレームを見つけ、そこでクリップをカットします。設定パネルでオンにします。

- **テストするフレーム数**は、Nodaro が比較するフレームの数で、4〜64 です。デフォルトは 16 です。
- **品質**：**精密**は、正確なフレームでカットしますが、画質がわずかに落ちます。**ロスレス**は、キーフレームでカットし、ファイルを 1 バイトも変えずに保ちます。

完璧なループにするには、**開始フレーム**と**終了フレーム**に同じ画像を接続します。終了フレームがなくても、Nodaro は見つけた中で最適なループポイントを選びますが、ループのつなぎ目で映像が飛ぶことがあります。ループトリミングは、VEO 3.1 がループの最後に加えるフェードも取り除きます。

ループトリミングには、少額の料金がかかります。クリップ 5 秒ごとに 1 クレジットと、テストするフレーム 24 枚ごとに 1 クレジットで、それぞれ切り上げです。たとえば、8 秒のクリップで 16 フレームをテストすると、3 クレジットが加算されます。トリミングに失敗した場合は、トリミング前のクリップが残り、ループトリミングのクレジットは返還されます。

## キャラクターの一貫性を保つ
- **アセットを接続する**：[キャラクターアセット](https://nodaro.ai/docs/nodes/assets/character)、[ロケーションアセット](https://nodaro.ai/docs/nodes/assets/location)、[オブジェクト／小道具アセット](https://nodaro.ai/docs/nodes/assets/object)、[動物／クリーチャーアセット](https://nodaro.ai/docs/nodes/assets/creature)のノードを**アセット**に接続します。Nodaro は、承認済みの画像と説明をプロンプトと一緒に送ります。
- **メンションする**：プロンプトに `@maya` と書くと、文の中の必要な位置にキャラクターを正確に置けます。`@maya:1:clothes` のようにメンションに役割を付けると、リファレンスから何を取り入れるかを指定できます。[リファレンスの役割](https://nodaro.ai/docs/guides/reference-roles)を参照してください。
- **送られる内容を確認する**：設定パネルの**挿入されたリファレンス**の一覧に、モデルが受け取るすべてのリファレンスが表示されます。ドラッグして並べ替えたり、× をクリックして削除したりできます。
- **ボードを使う**：画像生成で作ったリファレンスボードや一貫性グリッドを使うと、複数のクリップで顔が安定します。**シーンレシピ**のプリセットは、こうしたボードを読み取るように作られています。[リファレンスボード](https://nodaro.ai/docs/guides/reference-boards)を参照してください。

方法の全体は、[キャラクターの一貫性](https://nodaro.ai/docs/guides/consistent-characters)を読んでください。

## プリセット
ノードの**プリセット**を開くと、すぐに使える設定が用意されています。各プリセットは、合ったモデル、アスペクト比、長さを選び、プロンプトに `{placeholder || default}` 形式の差し込み枠を入れます。さらに、ゆがみ、ちらつき、形の崩れを防ぐように調整したネガティブプロンプトを追加します。プリセットは、編集せずにそのまま実行できます。値を入れていない差し込み枠には、それぞれのデフォルト値が使われます。

| フォルダー | 例 |
| --- | --- |
| **カメラワーク** | スロープッシュイン、ドリーアウト（全景を見せる）、360° オービット、クレーンアップ、トラッキング（追従）、ウィップパン、ドリーズーム（めまいショット） |
| **ショットの種類とアングル** | エスタブリッシングショット（ワイド）、クローズアップ、マクロディテール、ローアングルのヒーローショット、真俯瞰（トップダウン）、FPV ドローンのフライスルー |
| **シネマティックと特殊撮影** | 手持ちカメラのドキュメンタリー、スローモーション、タイムラプス、ハイパーラプス、バレットタイム、ピント送り（ラックフォーカス） |
| **SNS とリール** | 縦型ヒーローショット、トーキングヘッド、商品お披露目（縦型）、トレンド系クイックカット、POV ウォーク（縦型）。すべて 9:16 です。 |
| **商品と広告** | 商品ヒーローショット、商品 360° 回転、液体スプラッシュ、開封動画、ライフスタイル広告 |
| **モーショングラフィックスとロゴ** | ロゴ演出、タイトル登場、パーティクル背景、ループ背景 |
| **B ロールと自然** | 雲のタイムラプス、水のスローモーション、森を漂う、空撮の風景、海のループ |
| **アニメーションとスタイル** | アニメ調モーション、3D カートゥーン、クレイアニメ、動く水彩画 |
| **ループと背景** | さりげない動き、動く壁紙 |
| **バイラルとエフェクト** | 氷漬け、スーパーヒーローへの変身、エレベーターの扉が開く、POV スカイダイブ、水中 POV。入力画像があると最適です。 |
| **シーンレシピ** | バズる隕石シーン、カートゥーン短編（オープニング、追いかけっこ、結末）、2 人のキャラクターの会話、背後の大災害、追跡シーン。ネイティブオーディオ付きの Seedance 2 のシーンで、引用符で囲んだセリフはリップシンクされます。リファレンスボードやキャストグリッドを、リファレンス画像として接続してください。 |
| **動画編集** | **動画を編集**：Seedance 2.5 で、**動画リファレンス**のクリップを指示に従って編集します。変更したい内容をプロンプトとして入力します。 |

複数のシーンレシピをつないで 1 本の短編にするには、[動画を結合](https://nodaro.ai/docs/nodes/video/combine-videos)の**シームレス結合（ワンカット）**プリセットでクリップをつなぎます。自分のプリセットを保存して共有する方法は、[プリセット](https://nodaro.ai/docs/concepts/presets)を読んでください。

## クレジット
実行する前に、ノードの料金バッジで料金を確認できます。料金は、モデル、長さ、解像度によって決まります。モデルによっては、サウンドとリファレンスによっても変わります。

- **クリップごとの定額料金**：VEO 3.1 は、4 秒、6 秒、8 秒のどれでも同じ料金です。VEO 3.1 Lite は 720p で 75 クレジット、1080p で 90 クレジットです。VEO 3.1 Fast は 720p で 150 クレジット、1080p で 170 クレジットです。VEO 3.1 Quality は、1080p のクリップで 1,000 クレジットです。
- **長さごとの料金**：Gemini Omni と Gemini Omni Flash は、長さと解像度ごとに料金が決まっています。Gemini Omni Flash は、720p か 1080p で、4 秒なら 160 クレジット、10 秒なら 320 クレジットです。動画の編集は 1 回の実行ごとの定額料金で、720p か 1080p で、Gemini Omni Flash は 420 クレジット、Gemini Omni は 600 クレジットです。
- **秒単位の料金**：Seedance 2 ファミリー、Seedance 2.5、Hailuo 3、Wan 3.0、Grok Imagine Video 1.5、HappyHorse 1.1 は、秒単位で料金が決まります。たとえば Wan 3.0 は、720p の 5 秒で 200 クレジット、1080p の 8 秒で 640 クレジットです。
- **リファレンスで Seedance が安くなる**：Seedance 2 ファミリーと Seedance 2.5 では、リファレンスを 1 つでも接続すると、1 秒あたりの料金が安くなります。Seedance 2 の 1080p で 8 秒のクリップは 2,040 クレジットですが、リファレンスがあれば 1,240 クレジットです。
- **サウンドで料金が上がることがある**：Kling 3.0 は、10 秒のクリップがサウンドなしで 680 クレジット、サウンドありで 1,000 クレジットです。Kling 3.0 では、オフにしない限りサウンドはオンです。
- **リファレンス動画の長さも料金に含まれる**：Seedance 2 ファミリーと Hailuo 3 では、各リファレンス動画の秒数と出力の秒数の合計に料金がかかります。Hailuo 3 の 2K で、出力が 8 秒、リファレンス動画が 5 秒の場合は 1,187 クレジットです。Wan 3.0 では、リファレンス動画による追加料金はありません。
- **Hailuo 3 の追加画像**：入力画像が 5 枚を超えると、1 枚ごとに少額の料金が加算されます。2K で 6 秒のクリップに画像を 8 枚使うと、550 クレジットではなく 630 クレジットになります。
- **自動の長さは実行後に精算される**：**長さ**を**自動**にすると、Nodaro はそのモデルの最長のクリップの料金を確保します。Seedance 2.5 では 30 秒、ほかの Seedance 2 のモデルでは 15 秒です。クリップができあがると、実際の長さの分だけを支払い、残りは返還されます。実行を始めるには、確保する額をまかなえる残高が必要です。
- **編集も実行後に精算される**：リファレンス動画を使う Seedance 2.5 の実行では、指定した長さとクリップの長さのうち長いほうで料金が確保され、実際に出力された長さで精算されます。
- **接続した設定は、実行時の値で料金が決まる**：**設定**入力にプロバイダーノードや長さノードが接続されている場合、料金は、接続したモデルと、モデルに合わせた長さで計算されます。[「設定」入力](#settings-input)を参照してください。

正確な料金は、各モデルのページに記載されています。料金の確保と返還の仕組みは、[クレジット](https://nodaro.ai/docs/concepts/credits)を参照してください。

### 設定がモデルに対応していない場合
保存したワークフローに、現在のモデルでは選べない解像度、アスペクト比、長さが残っていることがあります。たとえば、モデルを切り替えた後です。その場合も、Nodaro は実行を失敗させません。値をモデルが受け付けるものに補正し、補正後の値で料金を請求します。モデルが実際に作るのも、補正後の値のクリップだからです。

- **最も近い値が使われる**：1080p までのモデルで 4K を指定すると、1080p でレンダリングされます。縦長の 9:21 は 9:16 になり、横長になることはありません。
- **解像度が空の場合は、料金の計算に使った解像度で送られる**：使われた値は、実行の記録に残ります。
- **自動調整と自動はそのまま**：これらは、入力に合わせるようモデルに指示する値です。
- **長さは設定した値のまま**：ただし LTX 2.3 は例外で、最も近い長さに変わります。LTX 2.3 で 7 秒を指定すると、6 秒でレンダリングされ、6 秒分の料金がかかります。
- **接続した長さノードの値はモデルに合わせられる**：**設定**入力から来た長さは、常にモデルが作れる最も近い長さで実行され、その長さの分の料金を支払います。
- **Hailuo 3 と Wan 3.0**：対応していない解像度の場合は、決まったデフォルトでレンダリングします。Hailuo 3 は 2K、Wan 3.0 は 720p です。料金は、実際にレンダリングした解像度に従います。

## モデルがプロンプトをブロックしたとき
一部のモデルは、完成したクリップをコンテンツポリシーに照らして確認し、拒否することがあります。たとえば、保護された映画やテレビのコンテンツに似ている場合です。そうなった場合、Nodaro はプロンプトを 1 回だけ書き直します。書き直したプロンプトでは、被写体、カメラワークの表現、ムードは変えずに、拒否の原因になった部分を和らげます。その後、Nodaro は追加のクレジットなしでクリップをもう一度実行します。2 回目も拒否された場合は、モデル自身が示した理由とともに実行が失敗します。

## 以前の「テキストから動画」と「画像から動画」ノード
動画生成は、以前の**テキストから動画**（Text to Video）ノードと**画像から動画**（Image to Video）ノードに代わるノードです。これらのノードを含む保存済みのワークフローを開くと、代わりに動画生成ノードが置かれています。接続は対応する入力に移り、モデル、設定、料金は変わりません。何も変更する必要はありません。

## ヒント
- **重要な言葉は先に書く**：モデルのプロンプトの上限を超えたテキストは切り捨てられます。Kling 2.6 では 1,000 文字までしか使えません。
- **下書きは安く、仕上げは鮮明に**：Seedance 2.0 Fast か VEO 3.1 Lite を低い解像度で使って試行錯誤し、最終的なクリップではモデルか解像度を切り替えます。
- **絵ではなく動きを書く**：開始フレームがある場合、シーンはすでに画像に写っています。プロンプトでは、何が動くかとカメラの動きを書きます。
- **カメラワークは名前だけでなく、動きを説明する**：カメラが物理的にどう動くか、何が静止しているか、ショットがどこで終わるかを書きます。[Camera Motion Lab](https://nodaro.ai/docs/research/camera-motion-lab) では、147 本のテストクリップをもとに、「orbit」や「dolly」のような用語だけの指示がなぜよく失敗するのかを示しています。
- **ルックはピッカーで指定する**：[カメラモーション](https://nodaro.ai/docs/nodes/creative-controls/camera-motion)や[ライティング](https://nodaro.ai/docs/nodes/creative-controls/lighting)などのピッカーは、検証済みの言い回しを追加します。ピッカーの設定は、プロンプトを書き直さずに変えられます。
- **1 つのノードで多くのショットを作る**：ノードをコピーする代わりに、ショットのプロンプトを並べた[**リスト**（List）](https://nodaro.ai/docs/nodes/automate/list)を 1 つの動画生成ノードに接続します。そうすれば、すべてのショットのモデルを 1 回で設定できます。
- **複数の動画ノードを 1 つのモデルにそろえる**：1 つの[プロバイダー](https://nodaro.ai/docs/nodes/settings/provider)ノードを各ノードの**設定**入力に接続すると、1 か所でモデルを切り替えられます。
- **モデルが使うものだけを接続する**：設定パネルはモデルが対応していない項目を隠しますが、別のモデルで設定した値はノードに残ります。

## トラブルシューティング
**実行が無効で、ツールチップにモデル名が表示される**：そのモデルには、テキストから動画のモードがありません。**開始フレーム**に画像を接続するか、テキストからクリップを作れるモデルを選んでください。

**実行が無効で、ノードのチップが赤い**：**設定**入力に接続したプロバイダーノードに、画像モデルなど、このノードでは実行できないモデルが設定されています。プロバイダーノードで、このノードの動画モデルを 1 つ選んでください。ワークフローの実行は、料金がかかる前にこのノードで止まり、そのエラーにはプロバイダーノードの名前が示されます。

**クリップの長さや形が、接続した設定と違う**：モデルがその長さや比率を作れないため、ノードは最も近い値で実行されます。ノードのチップには、実行に使われる値が表示されます。[「設定」入力](#settings-input)を参照してください。

**最初のフレームの後で、クリップがわずかに飛ぶ**：モデルが開始フレームの形を変えています。**フレームの調整**を**出力サイズに合わせる**に戻してください。

**Seedance 2.0 で、最初のほうのフレームがズームされたり暗くなったりする**：**フレームの送信形式**を**リファレンス画像**に設定するか、**自動**のままにしてください。Seedance 2.0 ファミリーでは、**自動**でもリファレンス画像として送られます。

**入力が使われないという表示がノードに出る**：モデルが受け付ける数より多くのリファレンスを接続したか、VEO の終了フレームとリファレンス画像のように、モデルが同時に使えない入力を組み合わせています。入力を減らすか、上限の高いモデルを選んでください。

**実行前にリファレンスのクリップが拒否される**：リファレンスの動画かオーディオのクリップが、モデルの長さの制限から外れています。[動画のトリミング](https://nodaro.ai/docs/nodes/video/trim-video)か[**オーディオのトリミング**（Trim Audio）](https://nodaro.ai/docs/nodes/audio/trim-audio)で短くしてから、もう一度実行してください。クレジットは使われません。

**Wan 3.0 の実行が、開始後に失敗する**：Wan 3.0 は、リファレンス動画の制限を実行中に確認します。確保したクレジットは返還されます。リファレンス動画を短くして、もう一度実行してください。

**Seedance 2.5 の結果の長さや形が、設定と違う**：モデルがプロンプトをリファレンス動画の編集として扱ったため、クリップ本来の比率と長さが保たれています。[クリップを編集する](#edit-a-clip)を参照してください。

**Gemini Omni で 4K が拒否される**：無料プランでは 4K を使えません。720p か 1080p を選ぶか、プランをアップグレードしてください。

## API から
上記の設定はすべて、`POST /v1/generate-video` を通じて、コードや AI アシスタントからも使えます。以前のルートである `POST /v1/text-to-video` も引き続き使え、動作は同じです。

- **ID で演出を指定する**：`{ "cameraMotion": "dolly-in", "timeOfDay": "dawn" }` のように、ピッカー ID をまとめた `direction` オブジェクトを送ると、Nodaro がそれに対応する言い回しをプロンプトに書き込みます。有効な ID は `GET /v1/picker-catalogs` で取得できます。[ピッカーカタログ](https://nodaro.ai/docs/developers/picker-catalogs)を参照してください。
- **フレーム**：`frameFit` と `frameDelivery` で、**フレームの調整**と**フレームの送信形式**を設定します。
- **補正**：補正された値は、`adjustments` 配列で返されます。
- **デフォルト**：`provider` を指定しないリクエストは、Seedance 2 Fast で実行されます。`duration` も指定しない場合は、4 秒のクリップが作られます。
- **キャラクターの声**：VEO 3.1、Kling 2.6、Kling 3.0、Kling 3 Omni、Seedance 2 ファミリー、Hailuo 3 など、セリフを話せるモデルでは、`characterVoices` と `dialogue` を渡せます。すると、クリップはキャラクターの保存済みの声で話します。追加料金は、VEO と Kling では 40 クレジット、Seedance と Hailuo 3 では 1,000 文字ごとに 25 クレジットです。それ以外のモデルでは声は無視されますが、クリップは生成され、追加のクレジットはかかりません。

[単体のノードを実行する](https://nodaro.ai/docs/developers/api/nodes)と [MCP ツール](https://nodaro.ai/docs/mcp/tools)を参照してください。

## Frequently asked questions

### 動画生成ノードでは、どのモデルを選べばよいですか？

新しいノードは、低価格でサウンド付きの Seedance 2 Fast から始まります。ネイティブオーディオ付きで価格と品質のバランスがよいのは VEO 3.1 Fast です。上質なシネマティックショットには Kling 3.0 か VEO 3.1 Quality を、リファレンスをもとにショットを作る場合は Seedance 2 か Seedance 2.5 を使います。

### テキストから動画と画像から動画は、どうやって切り替えますか？

切り替える必要はありません。プロンプトだけなら、ノードはテキストから動画のクリップを作ります。「開始フレーム」に画像を接続すると、同じノードがその画像を動かします。さらに「終了フレーム」も接続すると、クリップは一方の画像からもう一方の画像へと移り変わります。

### 動画生成のクリップ 1 本には、何クレジットかかりますか？

料金は、モデル、長さ、解像度によって決まり、モデルによってはサウンドとリファレンスによっても変わります。実行する前に、ノードの料金バッジで料金を確認できます。たとえば、VEO 3.1 Lite は 720p のクリップで 75 クレジット、Seedance 2 は 720p の 8 秒で 820 クレジットです。

### 動画クリップはどのくらいの長さにできますか？

モデルによって異なります。1 回の実行で、VEO 3.1 は 4 秒、6 秒、8 秒、Kling 3.0 と Seedance 2 は最大 15 秒、Seedance 2.5 と Wan 3.0 は最大 30 秒のクリップを作れます。それより長い動画には、複数のセグメントをつないで 1 本のクリップにする「動画生成 Pro」を使います。

### 動画生成ではサウンドも作れますか？

VEO 3.1、Seedance 2 ファミリー、Kling 3.0、Gemini Omni、Hailuo 3、Wan 3.0 など、多くのモデルが映像と一緒にオーディオトラックを作ります。モデルが対応していれば「オーディオを生成」でオフにできます。自分のトラックを「オーディオ」入力に接続することもできます。

### 「テキストから動画」ノードと「画像から動画」ノードはどうなりましたか？

現在は動画生成ノードに統合されています。これらのノードを含む保存済みのワークフローを開くと、代わりに動画生成ノードが置かれ、接続、設定、料金はそのまま引き継がれます。
