脚本生成
AI で複数シーンの動画脚本を書きます。各シーンには、説明、アクション、ムード、長さ、カメラ、セリフ、そのまま使える画像プロンプトが付きます。
脚本生成(Generate Script)ノードは、短いプロンプトから、複数のシーンからなる構造化された動画脚本を書きます。各シーンには、ビジュアルの説明、アクション、ムード、推奨の長さ、そして画像生成(Generate Image)ですぐに使える画像プロンプトが付きます。必要に応じて、カメラの指示、セリフ、ロケーションの詳細、音楽のムード、効果音も加わります。7 つの出力が、脚本の各部分を、それを必要とするノードに送ります。
使いどころ
- 動画のストーリーボードを作ります。シーンごとに画像プロンプトを 1 つ作り、そこからシーンごとに画像 1 枚とクリップ 1 本を作ります。
- 解説動画、広告、製品デモ、SNS 動画のための構造化された脚本を作ります。
- セリフ、音楽のムード、効果音を、映像と一緒に計画します。
- 生成にクレジットを使う前に、動画の長さとテンポを計画します。
1 つのプロンプトから完成した映像をまるごと作ってほしい場合は、ストーリー → 動画(Story → Video)を使います。
クイックスタート
ノードを追加する
キャンバス上で Tab を押し、動画 › ストーリーと脚本 › 脚本生成を選びます。
動画の内容を説明する
テキスト(Text)ノードを追加し、テーマ、ストーリー、コンセプトを入力して、脚本生成のプロンプト入力に接続します。具体的に書いてください。「make a video」(動画を作って)よりも、「30-second product ad for a fitness app showing a morning routine」(朝のルーティンを見せる、フィットネスアプリの 30 秒の商品広告)のほうがうまくいきます。
脚本の構成を決める
設定パネルを開きます。シーン数と目標の長さ(秒)を設定し、必要に応じてトーンとスタイルガイドも設定します。
実行して出力を接続する
実行をクリックします。脚本がノードに表示されます。出力を、映像、声、音楽を作るノードに接続します。
入力と出力
脚本生成には、左端に 5 つの入力があります。
| 入力 | 接続できるノード | 説明 |
|---|---|---|
| プロンプト | テキストやプロンプト(Prompt)などのテキストノード | テーマ、ストーリー、コンセプトです。必須です。このノードには、プロンプトを入力する欄がありません。 |
| トーン | トーン(Tone)ノード、または任意のテキストノード | トーンを設定します。 |
| スタイルガイド | スタイルガイド(Style Guide)ノード、または任意のテキストノード | スタイルガイドを設定します。 |
| シーン数 | シーン数(Scene Count)ノード | シーン数を 1〜20 の範囲で設定します。 |
| 長さ | 長さ(Duration)ノード | 目標の長さ(秒)を 5〜600 の範囲で設定します。 |
接続した入力は、パネルに入力した値より優先されます。接続している間、パネルではその欄が読み取り専用になり、接続したノードの名前を示すチップが表示されます。これらの入力から接続をドラッグすると、対応するノードを追加できます。
7 つの出力は、それぞれ、選択中の脚本の一部を送ります。
| 出力 | 送る内容 | 接続先 |
|---|---|---|
| シーン | 脚本をテキストとして送ります。内容は、最初のシーンの画像プロンプトです。 | テキストを受け付ける入力。 |
| 画像 | すべてのシーンの画像プロンプトです。 | 画像生成のプロンプト入力。シーンが 2 つ以上ある場合、画像生成はシーンごとに 1 回ずつ実行されます。 |
| セリフ | 脚本のすべてのセリフです。それぞれに話者と感情が付いています。 | テキストから会話(Text to Dialogue)。その設定で脚本から N 行のセリフを入力をクリックすると、セリフがコピーされます。テキストから会話に独自のセリフがない場合は、実行時に脚本のセリフが使われます。 |
| 音楽 | すべてのシーンの音楽のムードです。同じムードは 1 回だけ含め、1 つのテキストにまとめます。 | 音楽生成(Generate Music)のプロンプト。 |
| 効果音 | すべてのシーンの効果音を、1 つのテキストにまとめたものです。 | テキストからオーディオ(Text to Audio)のプロンプト。 |
| キャラクター | 脚本のキャラクターです。各キャラクターを 1 回ずつ、名前、説明、ムード、アクション、位置と一緒に送ります。 | 脚本のキャラクターを読み取るノード。 |
| ロケーション | 脚本のロケーションです。各ロケーションを 1 回ずつ、名前、説明、時間帯、天候、ライティングと一緒に送ります。 | 脚本のロケーションを読み取るノード。 |
設定
| 設定 | 説明 |
|---|---|
| AI モデル | 脚本を書くテキストモデルです。デフォルトは Gemini 3.6 Flash です。名前、開発元、ティアで検索できます。 |
| 推論の強度 | 書き始める前にモデルがどれだけ考えるかを決めます。対応しているモデルで使えます。 |
| 詳細モード | Gemini モデル専用です。開発元のコントロールでモデルを実行するので、温度、最大トークン数、推論の全範囲が有効になります。これらのコントロールは、詳細モードをオンにすると表示されます。料金は 1 段階上のクレジットティアになります。ほかのモデルでは、このスイッチは無効になり、その理由が表示されます。 |
| シーン数 | 書くシーンの数で、1〜20 です。デフォルトは 5 です。シーン数入力で設定することもできます。 |
| スタイルガイド | すべてのシーンに適用する、ビジュアルと物語の方向性です。たとえば、カラーパレット、時代、視覚的なリファレンスなどです。テーマと一緒にモデルに送られ、{Node Label} の形でほかのノードを指定できます。スタイルガイド入力で設定することもできます。 |
| トーン | 脚本全体の感情的な調子です。たとえば「遊び心のある」「ドラマチック」「教育的」などで、最大 200 文字です。トーン入力で、トーンノードまたは任意のテキストノードから設定することもできます。 |
| 目標の長さ(秒) | 脚本が想定する全体の長さで、5〜600 秒です。デフォルトは 60 です。AI がこの長さを各シーンに割り振るので、シーンごとの長さはばらつくことがあります。長さ入力で設定することもできます。 |
| 前後のテキスト | ノードの実行時に、プロンプトの前後に追加されるテキストです。スタイルガイドには追加されません。ワークフローをアプリとして使う人には表示されません。プロンプトの前後のテキストを参照してください。 |
複数の脚本でこれらの値を 1 か所にまとめるには、値を入力する代わりに、生成設定のノードを対応する入力に接続します。
各シーンの内容
| 項目 | 内容 |
|---|---|
| シーン番号と名前 | シーンの位置と、短い名前です。 |
| ビジュアルの説明 | 映るものの詳しい説明です。 |
| アクション | シーンで起こることです。 |
| ムード | 1 つ以上の感情のトーンです。 |
| 長さ | 推奨の長さ(秒)です。 |
| 画像プロンプト | 画像生成ですぐに使えるプロンプトです。 |
| キャラクター | 各キャラクターの名前、説明、ムード、アクション、位置です。 |
| セリフ | 話されるセリフです。それぞれに話者、テキスト、感情が付きます。 |
| ロケーション | 名前、説明、時間帯、天候、ライティングです。 |
| 撮影 | ショットの種類、カメラアングル、カメラの動きです。 |
| 音楽のムードと効果音 | サウンドトラックの提案です。 |
脚本を編集する
実行が終わると、設定パネルに生成された脚本が表示されます。タイトル、シーン数と全体の長さ、そしてシーンごとのセクションです。シーンを開くと、ビジュアルの説明、アクション、ムード、長さ(秒)、画像プロンプト(「画像生成」用)を編集できます。出力が送るのは、編集した内容です。プロンプトをコピーをクリックすると、すべてのシーンの画像プロンプトがコピーされます。
すべての実行はノードの結果一覧に残り、出力は選択した結果に従います。
脚本ができたら、ノードのストーリーボードを拡大表示で、すべてのシーンのワークフローノードを作成できます。シーンごとにシーンノードを 1 つ作るシーンノードか、シーンごとに画像生成、動画、テキストから音声(Text to Speech)、動画とオーディオを結合(Merge Video & Audio)の各ノードを個別に作るパイプラインノードを選びます。最後に動画を結合(Combine Videos)ノードを追加し、すぐに画像の生成を始めることもできます。ダイアログには、ノードを作成する前に、見積もりのクレジットが表示されます。
プリセット
ノードのプリセットを開くと、トーン、シーン数、目標の長さを設定するフォーマット別のプリセットを使えます。テーマはプロンプトに入力します。
| フォルダー | プリセット |
|---|---|
| フォーマット別 | YouTube ショート/フック、解説(ハウツー)、広告/CM スポット、製品デモのナレーション、ランキング形式(トップ 5)、自撮り風の UGC 広告(フック・実演・証拠・感想) |
| 長文とストーリー | ポッドキャストの構成案、予告編ナレーション、ストーリービート |
クレジット
1 回の実行は、AI モデルのティア(エコノミー、スタンダード、プレミアム)に応じて、10、20、30 クレジットのいずれかです。デフォルトのモデルの Gemini 3.6 Flash は、エコノミーモデルです。詳細モードでは料金が 1 段階上のティアになり、オンにするとノードの料金バッジが更新されます。ティアについては、モデルの選び方を参照してください。
ヒント
- プロンプトは具体的に書く:商品、視聴者、長さ、フォーマットを明記します。
- トーンで一貫性を保つ:トーンはすべてのシーンに適用されるので、脚本全体が 1 つの感情的な調子に揃います。
- 見た目はスタイルガイドに書く:パレット、時代、視覚的なリファレンスを書くと、画像プロンプトに一貫性が出ます。
- 長さは計画として扱う:目標の長さは AI の指針になりますが、各シーンの長さは内容によって変わることがあります。
トラブルシューティング
実行が「needs a topic」または「プロンプトがありません」で止まる:脚本に書く題材がありません。テーマ、ストーリー、コンセプトを入力したテキストノードを、プロンプト入力に接続してください。トーン、スタイルガイド、シーン数、長さの各入力は設定を決めるだけで、テーマにはなりません。実行は開始前に止まるため、料金はかかりません。
よくある質問
関連ページ
画像生成
動画生成
テキストから会話
ストーリー → 動画
音楽生成
最終更新